阿里Qwen发布320亿参数QwQ-32B大模型
创始人
2025-03-06 12:40:31
0

2025-03-06 09:42:19 作者:狼叫兽

3月6日,阿里Qwen团队正式对外发布了其最新的研究成果——QwQ-32B大语言模型。这款模型拥有320亿参数,在性能上能够与参数量高达6710亿的DeepSeek-R1(其中370亿参数被激活)相媲美。

尽管QwQ-32B的参数量仅为DeepSeek-R1的大约1/21,但通过强化学习技术,该模型成功实现了性能上的显著提升。此外,阿里在这款推理模型中还集成了与Agent相关的能力,使其不仅能够使用工具,还能进行批判性思考,并根据环境反馈动态调整推理过程。

QwQ-32B在多项基准测试中接受了全面评估,涉及数学推理、编程能力和通用能力等多个领域。在数学能力测试AIME24评测集中,以及用于评估代码能力的LiveCodeBench测试中,QwQ-32B的表现与DeepSeek-R1相当,并且大幅优于o1-mini和相同规模的R1蒸馏模型。

同时,在由多位知名研究者主导的多个权威评测榜单中,QwQ-32B也取得了优异成绩。例如,在被称为“最难LLMs评测榜”的LiveBench、用于评估指令遵循能力的IFEval评测集,以及针对函数或工具调用准确性测试的BFCL中,QwQ-32B的得分均超过了DeepSeek-R1。

目前,QwQ-32B已经在Hugging Face和ModelScope平台开源,用户还可以通过Qwen Chat直接体验这一先进模型。

相关内容

热门资讯

地球生命起源有新解 或诞生于水... 王信强 斯坦福大学的一项研究显示,生命可能起源于水滴中的“微闪电”。也就是说,构成地球生命的第一个分...
优刻得与数道智算达成智算中心战... 近日,优刻得与智能计算领域创新企业北京数道智算科技有限公司(下称:数道智算)正式签署战略合作协议,双...
马化腾三大战略揭秘:从差点卖 ... 文 / 大力财经 作者 / 魏力 站在AI 时代的十字路口回望,腾讯的成功绝不是偶然。从 QQ 到微...
游戏ios系统管理:便宜好用且... **一、云手机在游戏群控管理中的重要性** 在当今的游戏世界里,特别是对于那些需要多账号操作或者...
局域网监控软件哪家好?5款高端... 你是否遇到过这样的烦恼: 公司网络突然变慢,却找不到原因? 员工上班时间刷视频、打游戏,工作效率低下...
钦州市中医医院引入联影AI影像... 进入2025年,人工智能(AI)技术在医疗领域的应用得到持续深化。为推进医院医疗服务从“信息化”向“...
魔法原子举办2025场景战略发... 3月26日,魔法原子举办「原子双生」2025场景战略发布会,正式推出人形机器人和四足机器人,并首次推...
西湖大学开发出精准定位脑疾病细... 2025-03-20 08:41:52 作者:狼叫兽 近日,西湖大学杨剑教授团队在脑疾病研究领域...
时隔两月半,微信内测爆更! 在多个新功能灰度放量后,微信官方终于发布了新版本更新。 就在昨晚(3 月 10 日), 微信安卓平台...
学而思“上新”,学习机的“参数... 来源:雪豹财经社 在小红书上,“学习机哪个牌子好用推荐”的相关笔记超过130万篇。面对市面上大量同质...