阿里Qwen发布320亿参数QwQ-32B大模型
创始人
2025-03-06 12:40:31
0

2025-03-06 09:42:19 作者:狼叫兽

3月6日,阿里Qwen团队正式对外发布了其最新的研究成果——QwQ-32B大语言模型。这款模型拥有320亿参数,在性能上能够与参数量高达6710亿的DeepSeek-R1(其中370亿参数被激活)相媲美。

尽管QwQ-32B的参数量仅为DeepSeek-R1的大约1/21,但通过强化学习技术,该模型成功实现了性能上的显著提升。此外,阿里在这款推理模型中还集成了与Agent相关的能力,使其不仅能够使用工具,还能进行批判性思考,并根据环境反馈动态调整推理过程。

QwQ-32B在多项基准测试中接受了全面评估,涉及数学推理、编程能力和通用能力等多个领域。在数学能力测试AIME24评测集中,以及用于评估代码能力的LiveCodeBench测试中,QwQ-32B的表现与DeepSeek-R1相当,并且大幅优于o1-mini和相同规模的R1蒸馏模型。

同时,在由多位知名研究者主导的多个权威评测榜单中,QwQ-32B也取得了优异成绩。例如,在被称为“最难LLMs评测榜”的LiveBench、用于评估指令遵循能力的IFEval评测集,以及针对函数或工具调用准确性测试的BFCL中,QwQ-32B的得分均超过了DeepSeek-R1。

目前,QwQ-32B已经在Hugging Face和ModelScope平台开源,用户还可以通过Qwen Chat直接体验这一先进模型。

相关内容

热门资讯

恒瑞医药创新药SHR-1826... 上证报中国证券网讯(记者 何昕怡)1月12日,恒瑞医药宣布,子公司苏州盛迪亚生物医药有限公司的创新药...
智能穿戴新突破:科大讯飞AI翻... 近日,在美国拉斯维加斯国际消费电子展CES 2026展会期间,国际公认的测试、检验和认证机构SGS联...
昇腾赋能 TransMLA:无... MLA(Multi-head Latent Attention多头潜在注意力架构)凭借低秩压缩KV缓...
原创 金... 近日,针对社交平台发布的疑似“擦边”广告语,金帝巧克力发布致歉声明,承认在营销投放监督和管理上存在严...
“声”入人心:2026年蓝牙耳... 2026-01-13 12:47:24 作者:狼叫兽 当新年的钟声敲响,我们总在寻找一种方式,让日...
掘金AI数据中心,这些中企站上... 中企是液冷市场中快速崛起的第三极,是AIDC储能市场的主导力量,也是柴油机与燃机轮机市场中的替代选择...
顺天装备申请真空热封设备专利,... 国家知识产权局信息显示,广州顺天装备制造有限公司申请一项名为“真空热封设备”的专利,公开号CN121...
AI算力:6家核心受益环节的隐... 一、算力即国力:AI算力的战略地位 AI算力,正如同工业时代的电力一般,成为数字经济时代的核心基础设...
海航航空技术取得航空器配件在位... 国家知识产权局信息显示,海航航空技术有限公司取得一项名为“一种航空器配件在位加温设备”的专利,授权公...
玻璃基板, 2026年的一匹黑... 文 | 半导体产业纵横 行业对待玻璃基板的态度已经发生了180度大转弯。 去年年中,媒体还在报道英...