首页 >科技

一个月四家发新旗舰:大模型竞赛提速,”该不该踩刹车”同步吵响


2026年9月,全球大模型赛道进入了新一轮高强度对垒。从月初到月中,国内外厂商几乎以周为单位往外抛新旗舰,把原本就密集的发布节奏又压缩了一档。

时间线拉出来看会更清楚。9月1日,Anthropic率先发布Claude Fable 5.1以及共享底层架构的Mythos 5.1,核心亮点落在性能翻倍、成本下降,同时针对企业数据合规的痛点做了设计。9月3日,OpenAI正式推出GPT-6 Astra,把产品定位明确锚定在具备自主执行能力的AGI级模型,这被视为其史上最大规模的训练项目,使用了超过10万块GPU。9月10日,DeepSeek V4.1-Flash上线,依托全新的Causal Encoder-Decoder架构,主推理效率提升。9月12日,xAI如期推出Grok 4.7,参数规模达到2.1万亿,较上一代的1.5万亿增长约四成。

进入本周,节奏仍未放缓。9月16日凌晨,谷歌发布Gemini 3.8实时对话模型,一次带来Gemini 3.8 Live与Gemini 3.8 Live Extended Thinking两款,并宣布与Salesforce、Genspark、Lumeris建立合作关系,称其为目前最出色的对话式人工智能模型。同一天,豆包大模型2.1 Pro完成更新,豆包二代手机以5499元起售;讯飞星火的全国产语音基座大模型上线;阶跃星辰发布StepAudio 3系列,其中Realtime模型在对话动态榜以98.9%居首,语音推理准确率据称达到99.7%。

一边是发布提速,另一边,关于要不要慢一点的争论也在这个月被彻底摆上台面。此前多家前沿实验室的负责人曾联合提示人工智能发展速度可能带来的风险,但这一立场在最近几天遭遇了资本与政治层面的双重反驳。

当地时间9月14日,英伟达首席执行官黄仁勋在洛杉矶一场科技峰会上演讲时接到美国总统特朗普的来电,随即开启免提。特朗普在电话中力挺人工智能与数据中心建设,把关于人工智能失控的担忧斥为骗局,并批评部分州拒绝为新建数据中心发放许可,称这类设施能为当地带来财富。黄仁勋则回应称,市场力量已经存在,不需要新的法律,也不需要新的监管。同日,Meta创始人扎克伯格在社交平台上呼应,认为安全责任应由各实验室自行承担,以能够安全训练的速度推进。

9月16日,OpenAI首席财务官也公开表示并不担心前沿人工智能的发展速度放缓,并称即使技术发展需要放慢,公司也会依据投资回报率来做商业决策,同时保留必要时减速的选项。这一表态与公司首席执行官此前公开支持审慎推进的立场,形成了微妙的对照。

市场层面的热度同样在推高预期。有消息称,OpenAI正磋商新一轮融资,估值可能超过1.2万亿美元。博通首席执行官则明确回应,完全没有重新考虑人工智能收入目标,并维持2027财年1150亿美元的AI半导体收入指引。

值得注意的是,真正让这场辩论具备现实分量的是底层约束。本轮旗舰模型普遍依赖更大的算力集群,十万卡级别的训练规模已不再是个别案例。有研究机构预测,2026年全球数据中心电力需求将达到161GW,同比增长约三成,到2030年电网供需缺口可能扩大到268GW。这意味着算力的天花板正在从买不买得起卡,转向电力与能耗能不能跟上。

也正因如此,国内近期印发的数字化与绿色化协同转型实施方案中,首次提出要构建生成式人工智能全生命周期资源消耗评估体系。这或许是个信号,大模型的扩张速度未来不仅要接受市场竞争的检验,也要接受能耗与碳足迹的约束。

技术的迭代不会停,但关于该不该踩刹车的讨论,已经不再只是实验室内部的辩论了。它正在变成一道需要产业、资本与监管共同作答的题。

/ 下一篇文章: /

从敦煌开进大海道:一档自驾文化节目,把丝路拍成了慢镜头