阿里Qwen发布320亿参数QwQ-32B大模型
创始人
2025-03-06 12:40:31
0

2025-03-06 09:42:19 作者:狼叫兽

3月6日,阿里Qwen团队正式对外发布了其最新的研究成果——QwQ-32B大语言模型。这款模型拥有320亿参数,在性能上能够与参数量高达6710亿的DeepSeek-R1(其中370亿参数被激活)相媲美。

尽管QwQ-32B的参数量仅为DeepSeek-R1的大约1/21,但通过强化学习技术,该模型成功实现了性能上的显著提升。此外,阿里在这款推理模型中还集成了与Agent相关的能力,使其不仅能够使用工具,还能进行批判性思考,并根据环境反馈动态调整推理过程。

QwQ-32B在多项基准测试中接受了全面评估,涉及数学推理、编程能力和通用能力等多个领域。在数学能力测试AIME24评测集中,以及用于评估代码能力的LiveCodeBench测试中,QwQ-32B的表现与DeepSeek-R1相当,并且大幅优于o1-mini和相同规模的R1蒸馏模型。

同时,在由多位知名研究者主导的多个权威评测榜单中,QwQ-32B也取得了优异成绩。例如,在被称为“最难LLMs评测榜”的LiveBench、用于评估指令遵循能力的IFEval评测集,以及针对函数或工具调用准确性测试的BFCL中,QwQ-32B的得分均超过了DeepSeek-R1。

目前,QwQ-32B已经在Hugging Face和ModelScope平台开源,用户还可以通过Qwen Chat直接体验这一先进模型。

相关内容

热门资讯

天有为电子取得一种超薄显示屏专... 金融界2025年6月18日消息,国家知识产权局信息显示,黑龙江天有为电子股份有限公司取得一项名为“一...
贵州仁怀:千亩稻田开启“智慧夏... 仲夏时节,贵州省仁怀市茅坝镇官院村的千亩稻田里,无人机忙着施肥,智能监控实时记录数据,这幅“空中飞旋...
微信将迎重大更新!网友:聊天记... 近日有消息称,微信正在优化聊天记录备份的功能,支持U盘等多种存储设备。 对此,微信方面回应称,正小范...
原创 苹... 有句话怎么说来着?“安卓用三年,心态练半年”。这当然是句玩笑话,但谁用谁知道,安卓手机再高端,也总有...
石家庄科技大讲堂举行 马宇骏主... 石家庄科技大讲堂举行 孙富春作专题讲座 马宇骏主持并讲话 6月17日下午,石家庄科技大讲堂在石家庄信...
“人工树叶”新进展:太阳能制氢... 新华社天津6月18日电(张建新、栗雅婷、赵晖)近日,我国科研人员研发了一种高效、稳定的半透明光电阳极...
今日重大通报!x-poker外... 今日重大通报!x-poker外挂辅助APP,聚星扑克有挂,详细教程(有挂技术)-哔哩哔哩;聚星扑克黑...
必备攻略!德扑之星比赛外挂辅助... 必备攻略!德扑之星比赛外挂辅助软件,哈糖大菠萝切牌规律,详细教程(有挂解密)-哔哩哔哩;德扑之星比赛...
最新研发!wpk助手外挂透明挂... 最新研发!wpk助手外挂透明挂辅助APP,GG扑克辅助软件,详细教程(有挂方式)-哔哩哔哩;支持2-...
吴晓波:学大模型,现在是个好时... “我们的目光所及,只是不远的前方,但是可以看到,还有许多工作要做。” ——艾伦·图灵 文 / 吴晓...