蚂蚁回应新模型训练成本降低:基于不同芯片持续调优,会逐步开源
创始人
2025-03-25 07:21:29
0

IT之家 3 月 24 日消息,据新浪科技报道,针对有关蚂蚁“百灵”大模型训练成本有关消息,蚂蚁集团回应称,公司针对不同芯片持续调优,以降低 AI 应用成本,目前已经取得一定进展,也将逐步通过开源分享。

IT之家附事件背景:

近日,蚂蚁集团 Ling 团队在预印版 Arxiv 平台发表技术成果论文《每一个 FLOP 都至关重要:无需高级 GPU 即可扩展 3000 亿参数混合专家 LING 大模型》,宣布推出两款不同规模的 MoE (混合专家)大语言模型 —— 百灵轻量版(Ling-Lite)与百灵增强版(Ling-Plus),并提出一系列创新方法,实现在低性能硬件上高效训练大模型,显著降低成本

百灵轻量版参数规模为 168 亿(激活参数 27.5 亿),增强版基座模型参数规模高达 2900 亿(激活参数 288 亿),性能均达行业领先水平。实验表明,其 3000 亿参数的 MoE 大模型可在使用国产 GPU 的低性能设备上完成高效训练,性能与完全使用英伟达芯片、同规模的稠密模型及 MoE 模型相当。

相关内容

热门资讯

阿里合伙人委员会点名批评钉钉团... 6月10日,阿里巴巴合伙人委员会在内网发布帖文《有情有义有成长,才是阿里文化》,对连日来《置身钉内》...
2026年二手iPhone 1... 一、为什么iPhone 13至今仍是二手市场宠儿? 在2026年的智能手机市场,iPhone 13...
我国今年要打造超百个人形机器人... 中国青年报客户端讯(中青报·中青网记者 贾骥业)记者从工业和信息化部获悉,近日,该部与国务院国资委联...
2026年“小小科学家”校园巡... 6月10日,由哈尔滨市科协、市教育局共同主办的2026年“小小科学家”校园巡回报告会走进哈尔滨新区第...
重度听损哪款品牌好?国产平价助... 对于重度听损人群而言,听力障碍不仅是听不见声音,更是切断了与生活、社交、家人的情感联结。日常沟通需要...
原创 祛... 日前,百年保温杯品牌膳魔师(Thermos)因安全隐患被推上风口浪尖。 膳魔师在中国召回近400万件...
总结辅助挂!德普软件,功夫川麻... 总结辅助挂!德普软件,功夫川麻小程序辅助器,妙计教程(有挂方针)1、总结辅助挂!德普软件,功夫川麻小...
2026版软件!hhpoker... 2026版软件!hhpoker外挂靠谱吗,佛手在线辅助器,法子教程(有挂秘籍)1、每一步都需要思考,...
据公告内容!黑侠破解wepok... 据公告内容!黑侠破解wepoker,上品斗地主游戏辅助,指南书教程(确实有挂)1、据公告内容!黑侠破...
此事备受玩家关注!wepoke... 此事备受玩家关注!wepoker私人局辅助器怎么用,丰城双剑辅助,经验教程(详细教程)1、玩家可以在...