【关注】字节跳动发布豆包大模型2.0,主打真实世界复杂任务执行力
创始人
2026-02-20 09:00:39
0

在连续发布Seedance 2.0视频模型、Seedream 5.0 Lite图像模型之后,2月14日,字节跳动宣布推出豆包大模型2.0(Doubao-Seed-2.0)系列。豆包2.0针对大规模生产环境的使用需求进行系统性优化,旨在更好地完成真实世界的复杂任务。

在语言模型基础能力上,豆包2.0 Pro旗舰版取得IMO、CMO数学竞赛和ICPC编程竞赛金牌成绩,也超越了Gemini 3 Pro在Putnam基准测试上的表现,数学和推理能力达到世界顶尖水平。

大模型执行长链路复杂任务,需要丰富的世界知识。豆包2.0加强了长尾领域知识覆盖,在SuperGPQA等多项公开测试集上表现突出,科学领域知识测试成绩与Gemini 3 Pro和GPT 5.2相当,在跨学科知识应用上也排名前列。

在教育、娱乐、办公等众多场景中,大模型需要理解图表、复杂文档、视频等内容。对此,豆包2.0全面升级多模态理解能力,视觉推理、空间感知、长上下文理解等权威测试均取得业界最佳表现。

面对动态场景,豆包2.0增强了对时间序列与运动感知的理解能力,还可实现实时视频流分析、环境感知与主动交互,广泛应用于健身指导、穿搭建议、看护陪伴等生活场景。

Agent及推理能力部分评测成绩

Agent能力是大模型具备行动力的关键。测试成绩显示,豆包2.0 Pro在指令遵循、工具调用和Search Agent等评测中达到顶级水平,在HLE-Text(人类的最后考试)上更是获得54.2的最高分,大幅领先于其他模型。

目前,豆包2.0 Pro已在豆包App、电脑客户端和网页版上线,用户选择「专家」模式即可对话体验。火山引擎也已上线豆包2.0系列模型API服务。

据悉,豆包2.0 Pro按“输入长度”区间定价,32k以内的输入定价为3.2元/百万tokens,输出定价为16元/百万tokens,相比Gemini 3 Pro和GPT 5.2有较大的成本优势。豆包2.0 Lite更是极具性价比,综合性能超越两个月前发布的上一代主力模型豆包1.8,百万tokens输入价格仅为0.6元。(心月)

来源:环球网

相关内容

热门资讯

曝三星中国收缩手机业务布局 月... 【CNMO科技消息】8月3日,@新浪科技 报道,继三星电子宣布退出中国家电市场后,三星手机同样开始收...
基因编辑的商业化:一款产品22... 红星资本局8月3日消息,近日,一名6岁女童在接受基因编辑临床试验后死亡的事件,将“基因编辑”这项前沿...
澎湃思想周报|当菲尔兹奖得主加... 数学的奇异时刻:当菲尔兹奖得主加入OpenAI 当地时间7月23日,2026年国际数学家大会(Int...
警惕AI技术滥用毒化网络环境 警惕AI技术滥用毒化网络环境 核心观点: 技术本身无善恶,但如果滥用技术,导致应用边界失守,就将...
显微镜系列教程(一):显微镜基... 我们今天要讲的主题,是"视觉的终极延伸"——显微镜。它并不是凭空出现的机器,它的整条演进路线,都是从...
大理宾川金牛二小学子斩获全国无... 科创逐梦,津门争光。8月2日,第十届全国青少年无人机大赛全国总决赛在天津国家会展中心落下帷幕。本次大...
北大团队脑机接口带宽增强新范式 北大团队开辟脑机接口通信带宽增强新范式,调节α节律可提升人类信息接收上限 人民日报8月3日刊登北京...
原创 中... 大家一定听过中国版星链计划,却没想到总数超过三万颗,一次性申报就恐怖到近二十万颗。为什么中国人要玩命...
原创 神... 掐指一算,5月24日晚上23时08分那一声轰鸣把神舟二十三号送上苍穹后,天宫里的朱杨柱、张志远、黎家...
宇帷雷电继任者,英信公布AUR... IT之家 8 月 3 日消息,台湾地区内存模组企业宇帷 (AVEXIR) 十余年前曾推出过雷电 (R...