外界热议DeepSeek低调“上新”
创始人
2025-03-26 09:40:35
0

本报记者 刘 扬

中国人工智能初创公司深度求索(DeepSeek)24日深夜低调上线了DeepSeek-V3的新版本DeepSeek-V3-0324,参数量为6850亿,在代码、数学、推理等多个方面的能力再次显著提升,甚至代码能力追平美国Anthropic公司大模型Claude 3.7。不过,外界对于DeepSeek-V3-0324的关注并不仅仅因为该版本的能力提升,而是猜测它的发布是否意味着DeepSeek更新一代的V4与R2大模型的发布不远了。

在回答《环球时报》记者有关DeepSeek-V3新版本有哪些能力提升时,DeepSeek表示,一是新版本代码能力显著提升,接近Claude 3.7水平。例如,有用户在实测中发现,V3-0324能一次性生成800行无错误的网页代码,并实现动态响应式布局和交互效果。二是数学与逻辑推理能力增强。例如经典的“4升水壶问题”和数学竞赛题(如AIME 2025题目),部分表现接近专业推理模型。三是模型架构与开源生态。V3-0324采用MIT许可证,允许自由修改、分发及商业化应用,进一步降低了开发者的使用门槛。

清华大学新闻学院人工智能学院教授沈阳25日对《环球时报》记者表示,DeepSeek-V3-0324不仅是V3系列的一次迭代,更是中国AI技术崛起的又一力证。其在性能、效率和开源策略上的综合优势使其在全球大语言模型领域占据重要地位。未来,DeepSeek可能通过推理能力提升和多模态扩展来巩固技术领先优势,同时在中美竞争和社区生态中寻找平衡。沈阳认为,DeepSeek-V3-0324的发布看似是一次“小更新”,但其性能跳跃表明该团队可能在为后续重大版本(如传言中的DeepSeek-R2或V4)铺路。

路透社今年2月底引述3名知情人士的说法宣称,DeepSeek原计划在今年5月初发布R2,但现在希望尽早推出,具体时间尚未透露。此外,DeepSeek希望新模型在代码生成和多语言推理方面的表现进一步提升。不过,外媒的相关传言并没有得到DeepSeek公司的证实与回应。

沈阳表示,DeepSeek-V3-0324的推出进一步凸显中国AI企业在技术与成本上的竞争力。美国对华GPU出口限制可能促使中国企业加速国产硬件适配,同时其开源模式或引发西方厂商的连锁动作,例如推出更强闭源模型。2025年可能是中美AI竞争的分水岭。

沈阳认为,在OpenAI公司的GPT大模型要把通用大模型和推理大模型融合在一起的背景下,外界关注包括DeepSeek在内的中国头部大模型是不是最终也会出现这种合并的趋势。“这种可能是存在的,因为对于用户来说,并不关心大模型在回应自身问题时用的是什么类型的模型,更关心大模型能不能给出更为智能、合理的参考答案。”

相关内容

热门资讯

专访思谋吕江波:“AI+”时代... 2026年,是国家“十五五”规划的开局之年。这一新五年规划系统性勾勒出中国至2030年的发展蓝图,新...
苹果2026年首款iPhone... 快科技1月12日消息,苹果在去年2月份推出了iPhone 16e,时隔一年,外界预计苹果将会发布iP...
原创 小... 有没有一个品牌,总是想着“冲高端”,结果每次都是高端里最便宜的标准版卖得最好?如果说以前小米有这种现...
“脆硬”材料可“随心所欲”弯折 (来源:天津日报) 转自:天津日报 本报讯(记者 雷风雨)坚硬的晶体也能像橡胶一样弯曲?这一科幻场景...
数学地基的裂痕与突围:当严谨大... 你正漫步于一座名为现代数学的宏伟宫殿。殿堂之内,微积分的齿轮精密咬合,代数几何的曲面优雅延展,数论的...
互联网:信息流的高速公路 只要是你想买的东西,淘宝就能让你买到。比如,你想买一个cosplay(角色扮演)用的假发或者服装,去...
虽然豆包手机被各家大厂禁了,但... 2025 年 12 月,豆包手机助手技术预览版的发布引发热烈关注和讨论。 然而,人们的关注点一般都在...
太原市新增25项省级创新成果 1月7日,省工信厅公布《山西省新材料产业创新成果(第二批)清单》,包含36项技术、产品。其中25项来...
力争3年左右看病缴费不再“排长... □新华社记者 彭韵佳 徐鹏航 看病缴费“多次排队”“排长队”,这个困扰老百姓的烦心事有望解决。 国家...
洲明科技:牵手全球大模型第一股... 近日,洲明科技(300232.SZ)发布公告,公司全资子公司洲明香港作为投资者,成功认购北京智谱华章...