谷歌Gemini跌出全球排名前十:上新旗舰3.5 Pro再度缺席
创始人
2026-07-24 08:42:42
0

快科技7月23日消息,当地时间7月21日,谷歌旗下DeepMind对外推出三款全新Gemini轻量化模型,包含Gemini 3.6 Flash、Gemini 3.5 Flash-Lite以及行业专用模型Gemini 3.5 Flash Cyber。

与此同时,旗舰模型Gemini 3.5 Pro依然没有露面成为此次焦点。

而据第三方评测榜单数据显示,谷歌当前主力Gemini系列综合实力已经跌至全球榜单十名以外,在头部大模型竞速赛道中显现压力。

据官方披露信息,三款新模型定位清晰,主要面向规模化商用场景。

其中Gemini 3.6 Flash是主力模型,与上一代相比能使用更少的token,在相同成本下提供更高质量的工作;而Gemini 3.5 Flash-Lite则是快速、成本效益高的选项,适用于日常任务,如处理文档和搜索;Gemini 3.5 Flash Cyber是一种网络安全模型,专为发现和修补关键软件漏洞而构建。

但根据评测来看,此次谷歌的新模型在智能上并不出色,AI模型评测平台Arena.ai的研究显示,Gemini 3.6 Flash在前端代码竞技场中以1537分排名第12位。

而国内月之暗面最新发布的Kimi K3以1677分位列榜首,智谱GLM-5.2位列第四,Anthropic的Claude和OpenAI的GPT的多款系列产品位居前列。

第三方评测机构Artificial Analysis给出的结论是,Gemini 3.6 Flash在智能方面较3.5 Flash没有提升,智能指数得分50,但任务效率有所提高,Gemini 3.6 Flash的平均每任务时间为 1.3 分钟,较上一代减少超过50%,同时每任务成本略有降低。

这意味着,谷歌优化的更多是速度和成本,而不是模型能力本身。

而除了排行榜,开发者社区的反馈同样出现明显分化,不少开发者用谷歌新模型做任务时未看到很好的表现:“前端能力糟糕、空间推理也很差,我安慰自己这其实不是在高思考水平上运行的,但我不确定。”

有开发者评论道:“谷歌就像龟兔赛跑里的兔子,领先一段时间后就开始睡觉。”也有人直言,Gemini团队需要引入真正关心交付前沿模型的人。

相关内容

热门资讯

原创 一... 8月12日这天有点巧,荣耀官宣MagicOS 10八月版本第三批机型今晚推送,vivo的Origin...
澳门大学黄辉:智能体要走向规模... 过去一年,随着大模型推理能力持续提升,人工智能正在从“生成内容”走向“执行任务”。从代码生成、数据分...
扬州首个AI影视创作平台上线 近日,以“科创未来·影启新篇”为主题的AI影视创作平台上线活动在扬州宝应城南软件产业园科创中心举行。...
全球首款机器人手机开卖!预订突... 智东西 作者 | 程茜 编辑 | 心缘 智东西8月12日报道,刚刚,荣耀全球首款机器人手机荣耀Rob...
深耕科创载体运营,象屿集团助推... 生物医药是厦门重点布局的战略性新兴赛道,细胞治疗产业正借着地方专项法规的落地迎来规范化发展机遇。近期...
广东省信息通信行业第六届网络安... 8月10日,以“AI铸网 匠心守护”为主题的广东省信息通信行业第六届网络安全技能大赛在广州越秀国际会...
他在“无人区”,研究“看见世界... 中国电信研究院谢瞻远 作者/ IT时报 毛宇 编辑/ 潘少颖 孙妍 2024年夏,浙江宁波象山县海...
中鑫智连取得键合丝模具清洗机构... 国家知识产权局信息显示,福建泉州市中鑫智连半导体材料有限公司取得一项名为“一种键合丝模具清洗机构”的...
百度申请提供直播流的方法专利,... 国家知识产权局信息显示,北京百度网讯科技有限公司申请一项名为“提供直播流的方法、装置、设备、存储介质...
Counterpoint:eS... IT之家 8 月 12 日消息,Counterpoint Research 今日表示,长江存储在 2...