2026 年 6 月大模型格局:三分天下,格局初定
2026 年 6 月大模型格局:三分天下,格局初定
2026 年 6 月是大模型历史上最密集的发布月之一。中美头部玩家几乎同步亮出底牌,"三分天下"格局初现。
一、美国阵营
Anthropic Fable 5(6 月 10 日)
"Mythos 级"超级 AI,基准测试较 Opus 4.8 提升 10%+。定价翻倍至 $10/M 输入 + $50/M 输出 token。同期 Anthropic 启动 IPO,估值约 9650 亿美元。特朗普政府限制非美国公民使用,引发争议。
Google DiffusionGemma(6 月 12 日)
26B MoE 模型,采用扩散技术(类似图像生成)并行生成文本块,推理速度提升 4 倍。Apache 2.0 开源,18GB 显存即可运行。
Subquadratic SubQ(6 月 19 日)
迈阿密初创公司,稀疏注意力机制突破二次复杂度瓶颈。第三方评测显示比 FlashAttention 快 56 倍,支持 1200 万 Token 上下文。
二、中国阵营
智谱 GLM-5.2(6 月 17 日)
7440 亿参数,纯华为昇腾训练,MIT 开源。代码能力全球第二,市值触及万亿港元。
阿里 Qwen-AgentWorld(6 月 24 日)
全球首个原生语言世界模型,覆盖 MCP、Search、Terminal、SWE、Web、OS、Android 七大领域。AgentWorldBench 评测超越 GPT-5.4、Claude Opus 4.8 与 Gemini 3.1 Pro。
字节豆包 2.1 Pro(6 月 23 日)
编程、智能体、视觉语言三大方向突破。日均 Token 调用量突破 120 万亿,两年暴涨千倍。
三、范式转折:从 Token 到物理世界
第八届北京智源大会(6 月 12 日)的核心主题是 AI 从"预测下一个 Token"迈向**"预测下一个物理状态"**。
智源发布四大成果:
- Physis-v0.1:全球首个通用世界基座模型
- Brainμ 1.0:全球首个多模态神经科学大模型(登《Science》)
- RoboBrain Orca:"想、看、动"三位一体具身大脑
- Emu3.5:首个登《Nature》正刊的国内多模态模型
四、关键趋势
- Scaling Law 仍在生效——多位专家否认"触顶"说法
- 国产算力崛起——寒武纪实现 GLM-5 系列 Day 0 适配
- AI 自进化——百度 Dumate 90% 代码已由 AI 生成
- 地缘政治加速开源——美国出口限制反向推动中国开源生态
夏季达沃斯论坛(6 月 24 日)透露:中国日均 LLM Token 消耗已突破 100 万亿。
