阿里Qwen发布320亿参数QwQ-32B大模型
创始人
2025-03-06 12:40:31
0

2025-03-06 09:42:19 作者:狼叫兽

3月6日,阿里Qwen团队正式对外发布了其最新的研究成果——QwQ-32B大语言模型。这款模型拥有320亿参数,在性能上能够与参数量高达6710亿的DeepSeek-R1(其中370亿参数被激活)相媲美。

尽管QwQ-32B的参数量仅为DeepSeek-R1的大约1/21,但通过强化学习技术,该模型成功实现了性能上的显著提升。此外,阿里在这款推理模型中还集成了与Agent相关的能力,使其不仅能够使用工具,还能进行批判性思考,并根据环境反馈动态调整推理过程。

QwQ-32B在多项基准测试中接受了全面评估,涉及数学推理、编程能力和通用能力等多个领域。在数学能力测试AIME24评测集中,以及用于评估代码能力的LiveCodeBench测试中,QwQ-32B的表现与DeepSeek-R1相当,并且大幅优于o1-mini和相同规模的R1蒸馏模型。

同时,在由多位知名研究者主导的多个权威评测榜单中,QwQ-32B也取得了优异成绩。例如,在被称为“最难LLMs评测榜”的LiveBench、用于评估指令遵循能力的IFEval评测集,以及针对函数或工具调用准确性测试的BFCL中,QwQ-32B的得分均超过了DeepSeek-R1。

目前,QwQ-32B已经在Hugging Face和ModelScope平台开源,用户还可以通过Qwen Chat直接体验这一先进模型。

相关内容

热门资讯

8分钟了解!wpk德州透视辅助... 1、8分钟了解!wpk德州透视辅助(透明挂)确实是真的有挂(详细代打辅助教程);详细教程。2、wpk...
德州ai辅助!wpk发牌逻辑(... 德州ai辅助!wpk发牌逻辑(软件透明该)原来是真的有挂(详细辅助软件教程);是一种具有地方特色的麻...
三分钟了解!德扑ai操作(黑科... 三分钟了解!德扑ai操作(黑科技)的确真的有挂(详细辅助工具教程)关于德扑ai操作的基本介绍、功能特...
aapoker猫腻!来玩app... aapoker猫腻!来玩app德州扑克(软件透明该)其实真的有挂(详细辅助挂教程);亲们利用一分钟了...
三分钟了解!fishpoker... 大家肯定在之前fishpoker下载或者fishpoker下载中玩过三分钟了解!fishpoker下...
wepoke辅助机器人!wpk... wepoke辅助机器人!wpk辅助器小程序(透视)原来真的有挂(详细透视教程);wepoke黑科技是...
2分钟了解!德州智能辅助(黑科... 2分钟了解!德州智能辅助(黑科技)其实是真的有挂(详细辅助黑科技教程)1、每一步都需要思考,不同水平...
wepoke辅助有挂!wepo... 1、wepoke辅助有挂!wepoke软件下载(透视)确实真的有挂(详细透视脚本教程);该软件可以轻...
1分钟了解!wepoke线上(... 1分钟了解!wepoke线上(透明挂)其实真的有挂(详细辅助教程);是一款可以让一直输的玩家,快速成...
德州免费辅助神器app!wpk... 德州免费辅助神器app!wpk透明挂(黑科技辅助挂)的确是真的有挂(详细辅助软件教程);亲真的是有正...