2026年8月,AI行业迎来一系列重要变化。
8月13日,阿里云正式向公众开放Qwen3.8-Max模型的全部权重参数。该模型总参数量达2.4万亿,采用稀疏混合专家架构,单次激活约950亿参数,支持100万Token上下文。这是Qwen系列中首次开源Max级别模型。
同周,DeepSeek V4 Pro正式版上线,在Terminal Bench 2.1测试中拿下87.9分,距离全球第一的Anthropic Fable 5仅差0.1分。DeepSWE从预览版12.8提升至62.7。
一周之内,Grok 4.6、Gemini 3.7 Flash、DeepSeek V4 Pro、GLM-5.3四款前沿模型相继发布,均聚焦于长程Agent能力优化。
行业观察人士指出,顶级AI模型正在从“稀缺资源”走向“基础设施”。
01 模型价格持续下行
模型免费开源的同时,商业模型价格也在持续下降。
GPT-5.6 Luna降至$0.20/百万token,降幅约80%。Gemini 3.7 Flash入门价$0.75/百万input,约为3.6 Flash的一半。DeepSeek V4-Flash-High定价$0.14/$0.28。
模型商品化趋势明显,价格竞争日趋激烈。
有分析指出,当前沿大模型开始提供免费服务后,单纯依赖模型训练的商业路径面临挑战。而位于模型层之上的调度与路由能力,其战略价值反而持续上升。
02 调度层成为资本关注焦点
2026年8月16日,支付巨头Stripe宣布收购AI模型路由平台OpenRouter,交易金额超过70亿美元。三个月前,OpenRouter的估值约为13亿美元。
OpenRouter的核心功能是AI模型的“路由调度层”——用户无需分别对接各家模型服务商,只需对接OpenRouter一家平台。平台根据价格、速度、任务复杂度等维度自动选择最适合的模型。
公开数据显示,OpenRouter已聚合超过500个模型,月处理超过200万亿Token,毛利率达到71%。
行业分析认为,Stripe购买的并非模型技术本身,而是 “未来AI交易链路中的关键节点” 。在AI基础设施领域,占据调度层意味着掌握了流量分发与计费的核心位置。
03 调度逻辑的行业验证
值得关注的是,2025年10月,国内已有团队提出“调度算法”概念。时隔不到一年,全球资本以超过70亿美元的交易验证了同一方向。
行业共识正在形成:大模型正逐步“商品化”,价格竞争日趋激烈。真正具有长期价值的,是位于模型层之上的调度与路由能力。
一个典型的技术架构正在成型:
· 底层:异构大模型集群,作为基础算力资源
· 中间层:任务型智能体与自主型智能体,执行具体任务
· 顶层:企业级AI系统,负责整体调度与协同
04 开源模型的行业影响
据Hugging Face《开放模型现状》报告及相关公开数据,Qwen家族模型六个月全球下载量突破30亿次,位居全球开源模型下载量前列。
分析人士指出,开源模型的普及正在降低中小企业应用AI的门槛。但“获取模型”与“有效运用模型”之间存在显著差距。如何通过调度层将多个模型组合为可用的业务系统,正成为新的竞争力来源。
结语
2026年8月的一系列行业事件表明:AI模型正在从“稀缺资源”走向“基础设施”,价格持续下行。与此同时,位于模型层之上的调度与路由能力,正成为资本和行业关注的新焦点。
对于大多数中小企业而言,无需进行大规模技术投入,但可以通过优化AI服务的使用方式——关注调度层的引入与计费模式的重构——在一定程度上控制成本、提升效率。
在AI基础设施持续演进的背景下,关注“如何调度”或许比关注“用哪家模型”更具实际意义。
本文信息基于公开资料整理,仅供参考,具体以各平台官方信息为准。