您的当前位置:首页 > 百科 > AMD发布首个AI小语言模型:6900亿token、推测解码提速3.88倍 名为“AMD-135M” 正文
时间:2024-11-22 04:07:34 来源:网络整理 编辑:百科
快科技10月1日消息,AMD发布了自己的首个小语言模型(SLM),名为“AMD-135M”。相比于越来越庞大的大语言模型(LLM),它体积小巧,更加灵活,更有针对性,非常适合私
快科技10月1日消息,布首倍AMD发布了自己的语言亿首个小语言模型(SLM),名为“AMD-135M”。模型
相比于越来越庞大的推测提速大语言模型(LLM),它体积小巧,解码更加灵活,布首倍更有针对性,语言亿非常适合私密性、模型专业性很强的推测提速企业部署。
AMD-135小模型隶属于Llama家族,布首倍有两个版本:
一是语言亿基础型“AMD-Llama-135M”,拥有多达6700亿个token,模型在八块Instinct MIM250 64GB加速器上训练了六天。推测提速
二是解码延伸型“AMD-Llama-135M-code”,额外增加了专门针对编程的200亿个token,同样硬件训练了四天。
创建与部署流程
它使用了一种名为“推测解码”(speculative decoding)的方法,通过较小的草稿模型,在单次前向传播中生成多个候选token,然后发送给更大的、更精确的目标模型,进行验证或纠正。
这种方法可以同时生成多个token,不会影响性能,还可以降低内存占用,但因为数据交易更多,功耗也会增加。
AMD还使用AMD-Llama-135M-code作为CodeLlama-7b的草案模型,测试了推测解码使用与否的性能。
比如在MI250加速器上,性能可提升最多约2.8倍,锐龙AI CPU上可提升最多约3.88倍,锐龙AI NPU上可提升最多约2.98倍。
推测解码
AMD-135M小模型的训练代码、数据集等资源都已经开源,遵循Apache 2.0。
按照AMD的说法,它的性能与其他开源小模型基本相当或略有领先,比如Hellaswag、SciQ、ARC-Easy等任务超过Llama-68M、LLama-160M,Hellaswag、WinoGrande、SciQ、MMLU、ARC-Easy等任务则基本类似GTP2-124MN、OPT-125M。
年度超强小直屏!vivo小屏旗舰X200 Pro mini评测2024-11-22 03:29
雷军:小米SU7十月冲刺生产2万辆、交付2万辆2024-11-22 03:18
火了6年后 国潮开始塌房了2024-11-22 03:16
吉利汽车9月销量30.81万台再创新高!新能源渗透率49.5%2024-11-22 03:05
NVIDIA新旗舰卡RTX 5090大曝光:接口、功耗迎巨变2024-11-22 02:41
半价理想真香 零跑汽车国庆7天大定17397辆2024-11-22 02:21
60cm平嵌+双系统!小米米家冰箱分储鲜Pro十字508L首销:3999元2024-11-22 02:21
靓妹COS《剑星》女主伊芙:气质身材俱佳2024-11-22 01:51
奇瑞高管:未来顶多只有5家中国品牌存活下来2024-11-22 01:25
2024国庆档票房破21亿 《志愿军:存亡之战》超8亿夺冠2024-11-22 01:24
企业如何利用AI技术加速数字化革新 华为云CIO领航班第二期给出答案2024-11-22 03:34
249元!小米推出米家多功能电火锅6L:2000W功率/6挡火力2024-11-22 03:16
有人到手10多万 比亚迪回应突然向员工发放利润奖:情况属实2024-11-22 03:07
您已过完2024年所有法定假日:本周连上5天 周六不休息2024-11-22 03:05
外媒发长文称:《黑神话:悟空》不配TGA年度最佳提名2024-11-22 02:58
iQOO 13配置曝光:新一代骁龙8处理器+6100mAh新硅电池2024-11-22 02:55
鸿蒙智行发布战报:国庆假期累计大定突破2.86万台2024-11-22 02:54
荣耀X60系列定档10月16日发布:前代销量破1500万台 每2.7秒卖出一台2024-11-22 01:44
《真三国无双:起源》武将关羽介绍 美髯公魅力太大2024-11-22 01:38
青梅竹马到恋人 超甜!玩家分享蒂法、克劳德3D成长图2024-11-22 01:34