独立售卖页

大模型卷入“周抛时代”:谁最焦虑,谁又在狂欢?

今天(9月4日),OpenAI 发布新一代前沿模型 GPT-6Astra,并直接甩下一句:Welcome to the AGI era(欢迎来到AGI时代)。最近的大模型行业,新模型的出现简直像坐火箭。9月仅仅

单篇购买单篇购买文章2026-09-07 22:04:05
售卖与权益说明

当前内容支持公开查看。

人工智能www.chinaz.com购买后会立即写入“我的已购内容”,后续退款也回到统一内容权益链处理。
大模型卷入“周抛时代”:谁最焦虑,谁又在狂欢?

今天(9月4日),OpenAI 发布新一代前沿模型 GPT-6Astra,并直接甩下一句:Welcome to the AGI era(欢迎来到AGI时代)。

最近的大模型行业,新模型的出现简直像坐火箭。9月仅仅过去了四天,就有四家海外巨头轮番上阵。第一天,Anthropic宣布推出Claude Fable5.1和Mythos5.1。第二天,谷歌发布了Gemini3.8Flash和专攻网络安全的Gemini3.8Flash Cyber,Meta祭出Muse Spark1.3。

国内市场的发布节奏同样快得惊人。上一周,三家国内开源模型厂商发了新模型,阿里千问Qwen3.8-Flash、智谱GLM-5.3-Flash和腾讯混元Hy4preview都上线了。再往前推两周,DeepSeek V4Pro、Grok4.6、谷歌Gemini3.7Flash、智谱GLM-5.3接连在48小时内亮相。

Benchmark排行榜上,最强模型的保质期越来越短了,从登顶榜首到被超越,现在根本撑不过一周。模型厂商似乎要完成某种KPI一样,扎堆上线,“周抛”,正在成为大模型的新常态。

在最新模型的发布中,OpenAI 和谷歌都不约而同地提到RSI机制上的巨大飞跃。该机制的核心是AI 参与乃至改进自身研发流程、从而持续缩短模型迭代周期,全称是Recursive Self-Improvement(递归式自我改进)。

OpenAI 强调,Astra是第一款由前代模型深度参与训练监督的旗舰产品。谷歌 DeepMind 大牛姚顺宇表示,Gemini3.8Flash对 RSI 来说是一次巨大飞跃。

作为本轮模型发版加速的重要推手,RSI即将开启模型发布的新周期,可以预见模型进化的速度将会更快,周抛马上要成为过去式。

除了用模型加速自身的内部研究,另一个重要原因是,大模型研发正在从一次“造神”的大工程,变成越来越标准化的“流水线”式训练。

过去,新模型发布是一件很重的事情。无论是数据、训练周期还是算力,都需要巨额投入,研发周期动辄几个月甚至更久。模型厂商也不会轻易发版,一旦推出新模型,就意味着一次重大的“代际升级”,可能要被讨论上几个月。

基础模型训练方法越来越成熟,后训练、强化学习、推理优化、数据处理等环节也越来越工程化。一个新模型不一定意味着从头训练一个完全不同的巨型模型,而能够基于已有模型底座,通过强化推理、代码、Agent、视觉等特定能力,或者进一步优化速度、成本和上下文能力,快速推出一个新版本。

模型的“代际”概念也因此开始变得模糊。新模型不一定意味着一次彻底的技术跃迁,更像软件产品小版本迭代:能力有提升,体验有变化,价格可能更低,但底层架构未必发生翻天覆地的变化。

此前,智谱就明确表示,GLM-5.3和5.2使用同一个基础模型,所有提升全部来自后训练。阿里通义团队在发布 Qwen3.8-Flash-Next 的开源权重时透露,Next 新架构将是全新一代 Qwen4系列模型的雏形。