一周两件大事:AI 正在进入限量供应时代

这周 AI 行业发生了两件看似无关、实则指向同一个方向的事:

7 月 20 日:月之暗面 Kimi 发布公告,因 K3 发布后算力严重不足,即日起暂停 C 端新用户订阅服务。同一时间,Kimi 已通知投资者调整公司架构,筹备赴港 IPO。

7 月 8 日起:Fable 5 转为 Usage Credits 模式,需要 Persona 身份验证才能购买 credits。

供给端扛不住了

Kimi 暂停新用户这件事,表面原因是"K3 太火了",深层原因是:顶级 AI 模型的推理算力是有限的

一个 2.8 万亿参数的模型,每次推理的计算量是天文数字。即使月之暗面有充足的 GPU 储备,也架不住发布后用户暴增。K3 公布 48 小时内,注册用户数据说增长了数十倍——任何公司都扛不住这种增长曲线。

这让我想起今年年初 DeepSeek V3 发布后的情况:API 频繁限流、响应延迟暴增。不是模型不行,是算力不够。

Fable 5 的情况类似但原因不同——它不是算力不够,而是被政策"制造稀缺"。身份验证 + Usage Credits 模式人为地限制了用户数量。

稀缺意味着什么?

一瓶水在超市卖一块钱,在沙漠卖一百块。AI 能力也一样。

如果最先进的 AI(Fable 5、Kimi K3)变成稀缺资源:

  • 只有付费意愿最强的企业用户能稳定使用。个人开发者、学生、小团队会被挤出。
  • API 价格会上涨。即使标的价不变,实际使用成本会因为限流、排队而变高。
  • 开源模型的本地部署会加速普及。如果云端 API 又贵又慢,那把模型下载到自己的 GPU 上跑就成了合理选择——但这要求你有 GPU。

本质上,AI 正在从"人人可用的公共服务"退化为"需要资格才能享有的高级服务"。

这对开发者意味着什么?

几个务实的建议:

第一,不要把鸡蛋放在一个 API 篮子里。 你的应用应该能快速切换到不同的模型提供商。今天 Kimi 暂停新用户,明天可能是 OpenAI 涨价,后天可能是 Anthropic 改政策。适配层的抽象不是过度工程,是保险。

第二,本地模型值得投资。 不一定要跑 K3(2.8T 参数谁也跑不动),但 DeepSeek V4、Llama 4 7B/13B、Qwen 3 这些中小规模的开源模型在你自己的硬件上就能跑。对于 80% 的应用场景足够了。

第三,珍惜你的 API 配额。 Fable 5 的 Usage Credits 定价不会便宜,Kimi K3 即使"免费开放"也会有速率限制。把最强的模型用在最需要的地方——复杂推理、长程 Agent——普通任务用更便宜、更快的模型。

反思

一年前我们还在讨论"AI 什么时候变得太强",现在我们在讨论"AI 太强了以至于不够用了"。这个转向之快,所有人都没预料到。

AI 能力的供给瓶颈——不管是技术性的(算力不够)还是政策性的(出口管制)——将是接下来几年最重要的行业议题。

好消息是:竞争在加速。K2 发布一周后就是 K3。模型能力的军备竞赛没有减速的迹象。稀缺是暂时的,能力是增长的。

但在这个过渡期,开发者的策略需要从"尽情使用"转向"精明使用"。限量供应的不是 AI——是最好的 AI。


参考来源:

关于 Zihao Zhang

后端开发工程师。关注 Java/Spring Boot/Redis/MySQL 技术栈,分布式系统,OLAP 数据库,AI Agent 开发与应用。

评论

评论已关闭。