| RK | 大模型 | 企业 | 国家 |
|---|---|---|---|
| 1 | Claude Fable 5 | Anthropic | 美国 |
| 2 | DeepSeek-V4 | DeepSeek | 中国 |
| 3 | GPT-5.6 | OpenAI | 美国 |
| 4 | Kimi K3 | 月之暗面 | 中国 |
| 5 | Gemini 3.6 | Google DeepMind | 美国 |
| 6 | 豆包 | 字节跳动 | 中国 |
| 7 | 通义千问 | 阿里巴巴 | 中国 |
| 8 | Grok 4 | xAI(Grok) | 美国 |
| 9 | GLM-5.2 | 智谱 | 中国 |
| 10 | 混元 | 腾讯 | 中国 |
| 11 | 盘古 | 华为 | 中国 |
| 12 | H3 | MiniMax | 中国 |
| 13 | 文心一言 | 百度 | 中国 |
| 14 | Mistral Large 3 | Mistral AI | 法国 |
| 15 | MiMo | 小米 | 中国 |
| 16 | 讯飞星火 | 科大讯飞 | 中国 |
| 17 | Llama 4 | Meta | 美国 |
| 18 | Step 3.7 Flash | 阶跃星辰 | 中国 |
| 19 | 日日新 | 商汤科技 | 中国 |
| 20 | Command A | Cohere | 加拿大 |
| 2026.08 DBC/CIW/eNet16 | |||
据全球模型聚合平台OpenRouter数据测算,8月3日至9日,该平台统计口径下的AI大模型Token总调用量达69万亿,较前一周增长21.48%。其中,中国AI大模型周调用量达34.25万亿Token,环比增长21.76%,已经连续15周超过美国,稳居全球首位。
作为AI产业的“流量”,Token调用量直观反映了开发者、应用方对模型的实际使用规模,代表推理侧产业活跃度、外部开发者的接纳程度。我国AI大模型的Token调用量直线上升也反映了其在全球市场上的变化。
尤其当DeepSeek V4 Flash发布后,极致的“智效比”让它被称为大模型新的“斩杀线”,它不一定在每项测试里最强,但能力已经可以覆盖大量真实任务,而价格又足够低。
从AlphaGo称霸围棋界到ChatGPT面世,美国在算法大模型领域积累了显著的先发优势,但近几年中国大模型的崛起对全球AI格局有所冲击。美国《华尔街日报》等多家媒体提到,中国大模型独角兽月之暗面的新一代开源大模型Kimi K3正在撼动资本市场,并称其与DeepSeek在2025年发布时引发的市场恐慌如出一辙,连马斯克都赞其“令人印象深刻”。
赞誉声中,威胁悄然靠近。7月22日,白宫科技政策办公室主任迈克尔·克拉齐奥斯表示,月之暗面对美国人工智能企业Anthropic进行了蒸馏,从而开发出Kimi K3,美国财政部长贝森特威胁称,要用制裁和“实体清单”来应对中国企业的蒸馏。
阿里在Kimi K3发布三天后紧急preview Qwen 3.8-Max.2.4万亿参数,也宣称仅次于Fable 5。MoE架构、稀疏激活、FP8训练、MXFP4量化、强化学习后训练优化,这些算力稀缺大前提下的技术选择小前提,共同把顶级能力对算力的依赖,压到了硅谷童话里的几分之一。更重要的是,工程化降本的打法正在成为中国厂商的群体特征,群体效应会让算力堆砌的窗口更快关闭。
AI的成本结构和传统软件完全不同,AI有真实的COGS(销货成本),也就是推理算力,花钱规模直接挂钩收入规模。所以,中国厂商压低的不只是训练成本,也在挑战整个AI产业的经济结构。训练端的稀缺性被打破、推理端的成本战又被打响,硅谷讲给华尔街的“高投入换来高毛利”的逻辑,可能有朝一日就会崩塌。
“美国不应该禁止这类大模型。”英伟达首席执行官黄仁勋这样说,中国大模型非常优秀,人工智能技术将会渗透到更多行业。
结语
AI下半场不只是通过堆砌参数来抬高智能上限,更要让已有的智能真正进入业务流程。
(文/元素)
e-Mail:lab@enet16.com