大叔自由人
蹲的跳票了,没盯的全量了:Grok 四度延期、Kimi 静默升级与智谱的 50 亿——AI 发布的信用账
技术分享

蹲的跳票了,没盯的全量了:Grok 四度延期、Kimi 静默升级与智谱的 50 亿——AI 发布的信用账

蹲 AI 新闻的人,上周末体验很魔幻:蹲的那个跳票了,没盯的那个当晚全量上线了。

具体说:9 月 2 日马斯克放话「Grok 4.7 十天后上线,9 月 12 日见」,全社区蹲守;9 月 12 日发布日,等来的不是模型,是他本人确认延期。而前一天(9 月 11 日)晚上,月之暗面把 Kimi K2.8 悄悄全量上线了——没有发布会,没有倒计时,连 benchmark 都没公布。再过两天(9 月 13 日),智谱官宣 50 亿美元融资,把钱押在「完全自训练」上。

三件事凑在一起,正好拼出一篇我想写很久的主题:AI 发布的两种姿势,和一种正在贬值的货币——「预告」。

三种发布姿势

姿势一:喊话式——Grok 4.7 的预告-跳票循环

先把 Grok 4.7 的账摆出来。9 月 2 日马斯克在 X 放话:2.1 万亿参数(比一个月前刚发的 4.6 涨 40%)、喂了大量 SpaceX 独家工程数据、「性能超越所有现有 AI 模型」,还补了一句预防针式自信——「如果有模型在真实工程上比 4.7 更强,我会感到震惊」。9 月 12 日当天,等来的是延期确认,他自己坦承的原因是**「强化学习调优不当,仍需数天完善」**。什么值得买的社区盘点直接用了「第四次跳票」的说法。

这里有个值得玩味的叠加:就在跳票同一周,马斯克刚刚说过「达里奥说得对」(支持放缓前沿模型)。一边支持给全行业踩刹车,一边自己的旗舰因为赶工调优不当跳票——刹车论和跳票,居然说的是同一件事:模型公司自己也在承认,「快点发」和「发得好」已经冲突到藏不住了。

姿势二:静默式——Kimi K2.8 把版本号做成服务

K2.8 这次上线的方式,比内容本身更有信息量。三个细节:

其一,零配置升级。 Model ID 保持 kimi-for-coding 不变,官方客户端和第三方工具不用改任何配置,用户下一次发起请求,用的就已经是 K2.8——默认路由直接切换。知乎上有人点破了这层意思:这次更新的分量就在「默认路由」四个字上

其二,旗舰能力下放。 综合性能官方称「接近 K3」(K3 总参数 2.8 万亿),支持 low/high/max 三档 reasoning effort 与 K3 对齐,最实在的是 1M 上下文向所有会员档位开放——此前这是旗舰 K3 高阶会员的专属。其三,零营销。 没有发布会,没有 benchmark 通稿,连版本号都透着「顺手」。

为什么敢这么发?看商业账:外界获悉月之暗面的 ARR 从 6 月的 3 亿美元冲到 8 月突破 10 亿美元,公司正在冲刺港股 IPO。当收入模型跑通、升级成为日常,发布会就不再是必需品——版本号正在变成服务的形状,用户要的是「变好了」,不是「几.几」。这也呼应了 DeepSeek 那边 deepseek-flash 的命名思路:模糊版本号,强调持续演进。

照例泼半盆口径冷水:官方那句「典型任务耗时缩短 23%、内存占用降低 18%」是官方口径,「接近 K3」的「接近」程度,未公布 benchmark,自己测。社区实测帖也踩出了坑(Token 消耗、视频参考的格式限制),新东西第一周别上生产。

姿势三:资本式——智谱 50 亿美元与「递归」的两面

9 月 13 日智谱官宣完成约 50 亿美元融资:约 20 亿美元股份配售(每股 714 港元,较收盘价折让 9.96%)+ 约 30 亿美元零息可转债(初始转股价 892.50 港元,较配售价溢价 25%)。这是两个月内第二次大额动作(7 月刚做过约 314 亿港元配股)。约 60% 款项投向下一代 GLM 基础模型和「完全自训练」体系——公告里的定义值得抄下来:下一代 GLM 在上一代 GLM 构建的环境中训练,形成递归式自我改进循环

读融资要看条款:零息债+溢价 25% 转股,投资人赌的不是分红是上行空间——条款比口号诚实。但这里出现了一个微妙的镜像:上周 Amodei 警告的,恰恰是「递归自我改进正在急剧加速、可能超出人类掌控」;同一周,谷歌 DeepMind 的安全研究员 Josh Engels 离职加入独立评估机构 METR,理由是「未来五年 AI 造成巨大危害的概率高得吓人」。资本与安全,在同一个词的不同含义上,朝着相反方向下注——这个张力比任何单一新闻都值得记住。

综合判断:「预告」正在贬值

三张账单

把三种姿势放在一起,能读出三个结构性信号:

其一,预告的价值 = 内容 × 可信度,跳票记录是复利折扣。 参数数字再大,乘上四次跳票累积的折扣,净值趋近于零。马斯克的倒计时海报,边际效应已经为负。

其二,交付记录正在取代发布会的位置。 K2.8 的零配置升级说明:当升级足够频繁且可靠,「发布」这个事件本身会消失,剩下的只有 CHANGELOG 和用户实测。DeepSeek、Kimi 都在走这条路。

其三,财务信号比跑分诚实。 ARR 3 亿→10 亿(未经审计,注意口径)说明产品真的在被付费使用;融资条款里的折让和溢价,比任何「下一代」「全面超越」都更接近机构投资人的真实判断。

所以我的选型三看更新为:看 CHANGELOG 与实测(不看倒计时海报)、看 ARR 与收入结构(不看跑分)、看融资条款(不看融资金额)。这三条对个人选模型、公司选供应商、投资人选标的,一样适用。

一盆冷水

三句照例:其一,静默发布也会掩盖问题——K2.8 没公布 benchmark,好话都是官方口径,「静默」不天然等于「自信」,也可能等于「不想被测」;其二,ARR 10 亿美元是「外界获悉」口径,未经审计,港股 IPO 材料出来前打折听;其三,「Grok 4.8 万亿参数本周完训」目前只是传闻,别把传闻当预告,更别把预告当交付——这句话本身就是这篇的主题。

写在最后

土办法再升一版:判断一家模型公司,看它的交付节奏是否稳定,胜过看它的预告是否响亮。连续三周写了跑分、招聘、安全、发布四个维度,其实都在收拢到同一个判断——AI 行业正在从「叙事驱动」切换到「交付驱动」,凡是不跟着切换的参与者,明年这个时候会被动

我们给政企校做 AI 化改造时的选型逻辑也早换成了这套:供应商给的是倒计时海报还是 CHANGELOG,一问便知。有同类需求的团队,欢迎交流。


参考来源