8 月模型井喷:20 天内 11+ 新模型发布意味着什么?
Qwen3.8-Max、混元Hy4、GLM-5.3、DeepSeek V4、GPT-5.6 Sol 密集上线——从代际共振到入口之争的全面复盘。
一句话结论
2026 年 8 月是「智能体落地元年」的第一个爆发月:大模型端单月 11+ 旗舰发布(Qwen3.8-Max 2.4T、混元 Hy4 770B、GLM-5.3、DeepSeek V4 全系、GPT-5.6 Sol/Ultrafast)、智能体端「豆包工作」独立成军、腾讯 WorkBuddy 月访问破 2000 万、OpenAI 断供 Cursor 模型——竞争焦点从模型能力转向入口与生态。
三个值得注意的信号
1. 价格战进入「每 token 定价」阶段
混元 Hy4 开源定价 ¥6/百万 token、Qwen3.8-Flash ¥1/¥3、DeepSeek 峰谷计价——大模型竞争已经从能力榜转向每百万 token 的单价。对开发者,选型公式开始变成「能力 ÷ 单价 × 上下文」的工程函数。
2. 开源权重密度空前
中国五家实验室在 30 天内连发四款前沿权重(Kimi K3、Qwen3.8-Max、Hy4、DeepSeek V4-Vision),开源周期从季度压缩到月度——开源与闭源性能差实质性收窄,闭源旗舰的溢价空间被压缩。
3. Agent 是真正的战场
同月,字节「豆包工作」独立、腾讯 WorkBuddy 流量登顶、xAI 推 Grok Bot 挑战 OpenAI——模型只是底座,入口与工作流才是下一个十年的卡位。
对你的判断
- 开发者:8 月的模型矩阵意味着「模型氢价」:跑量用 Qwen/混元,推理/Agent 用 DeepSeek/Kimi,按 token 单价重排你的成本模型。
- 用户:免费 Agent 办公(豆包/元宝/文心)之间的差距在缩小,选「生态」而非「参数」。
- 观望者:8 月的代际共振不是终点,9 月 OpenAI Astra 与 Anthropic Fable 双旗舰同周发布,竞争还会更卷。
💡 常见问题
8 月最值得关注的新模型是哪个?▾
按影响度:Qwen3.8-Max(2.4T 首次开源 Max 级权重)、混元 Hy4(770B MoE+1M 上下文+¥6/MTok)、GPT-5.6 Sol/Ultrafast(速度极值)。取决于你关注能力、价格还是生态。
大模型价格还有下降空间吗?▾
有。开源权重压缩周期 + 国产算力成本下降,每百万 token 单价仍在周期下行;但峰谷/缓存等定价策略会替代简单降价。
下半年主线是什么?▾
入口之争(AI 办公/Agent 市集)与安全合规(标识办法/Agent 安全)——模型发布会继续,但真正的胜负手在落地。