"三天五件大事":8月中旬国产大模型的疯狂七十二小时
如果把 2026 年 8 月 12 日到 14 日这三天截取出来,你会看到国产大模型领域有史以来最密集的一次集体爆发——五件大事几乎在同一时间落地。
8 月 12 日,阿里云通义千问选择将 Qwen3.8-Max 的权重正式开源。这款总参数达到 2.4 万亿的旗舰模型,不仅是 Qwen 家族首个突破万亿参数的成员,也是 Max 级别首次开放权重,被视为阿里在开源生态上的一次重磅宣言。紧接着,8 月 14 日,阿里又进一步开源了轻量级的 Qwen3.8-27B,并采用宽松的 Apache 2.0 许可,把门槛降到最低。
几乎同一时间,DeepSeek 在 8 月 13 日发布了两件事:一是 V4-Pro 正式版(0813 版本)上线,二是首款 Agent 产品 Harness 启动公测并同步开源。前者代表了模型层面的性能升级,后者则把竞争延伸到了智能体工程层,两者叠加让 DeepSeek 的声量在那一周达到顶峰。
智谱则选择在 8 月 14 日发布 GLM-5.3。值得注意的是,GLM-5.3 的基座模型与 GLM-5.2 完全相同,它依靠后训练阶段的强化学习实现了能力的大幅跃迁——编程相关基准的得分从个位数跃升到更高的水平,还涌现出白盒代码审查与漏洞发现等网络安全能力。智谱方面表示,"可能还远未开发出这个基座的智能上界"。
这场"三天五件大事"背后,其实是一种被称为"后训练 Scaling"的技术路径。与传统的通过扩大预训练规模来提升能力不同,后训练 Scaling 是在相同基座上通过强化学习等阶段快速打磨能力,从而显著降低单次版本迭代的训练成本与周期。这正解释了为何国产模型可以如此高频地"小步快跑"。
斯坦福的人工智能指数报告也为此提供了佐证——中美顶尖模型的综合性能差距已收窄至 2.7%,技术迭代时差压缩到了 6 至 9 个月。当"发布新模型"的成本和周期被大幅压缩,国产大模型的"月抛时代"也就顺理成章地到来了。
(本文由示例插件追加)