这周 AI 行业发生了两件看似无关、实则指向同一个方向的事:
7 月 20 日:月之暗面 Kimi 发布公告,因 K3 发布后算力严重不足,即日起暂停 C 端新用户订阅服务。同一时间,Kimi 已通知投资者调整公司架构,筹备赴港 IPO。
7 月 8 日起:Fable 5 转为 Usage Credits 模式,需要 Persona 身份验证才能购买 credits。
供给端扛不住了
Kimi 暂停新用户这件事,表面原因是"K3 太火了",深层原因是:顶级 AI 模型的推理算力是有限的。
一个 2.8 万亿参数的模型,每次推理的计算量是天文数字。即使月之暗面有充足的 GPU 储备,也架不住发布后用户暴增。K3 公布 48 小时内,注册用户数据说增长了数十倍——任何公司都扛不住这种增长曲线。
这让我想起今年年初 DeepSeek V3 发布后的情况:API 频繁限流、响应延迟暴增。不是模型不行,是算力不够。
Fable 5 的情况类似但原因不同——它不是算力不够,而是被政策"制造稀缺"。身份验证 + Usage Credits 模式人为地限制了用户数量。
稀缺意味着什么?
一瓶水在超市卖一块钱,在沙漠卖一百块。AI 能力也一样。
如果最先进的 AI(Fable 5、Kimi K3)变成稀缺资源:
- 只有付费意愿最强的企业用户能稳定使用。个人开发者、学生、小团队会被挤出。
- API 价格会上涨。即使标的价不变,实际使用成本会因为限流、排队而变高。
- 开源模型的本地部署会加速普及。如果云端 API 又贵又慢,那把模型下载到自己的 GPU 上跑就成了合理选择——但这要求你有 GPU。
本质上,AI 正在从"人人可用的公共服务"退化为"需要资格才能享有的高级服务"。
这对开发者意味着什么?
几个务实的建议:
第一,不要把鸡蛋放在一个 API 篮子里。 你的应用应该能快速切换到不同的模型提供商。今天 Kimi 暂停新用户,明天可能是 OpenAI 涨价,后天可能是 Anthropic 改政策。适配层的抽象不是过度工程,是保险。
第二,本地模型值得投资。 不一定要跑 K3(2.8T 参数谁也跑不动),但 DeepSeek V4、Llama 4 7B/13B、Qwen 3 这些中小规模的开源模型在你自己的硬件上就能跑。对于 80% 的应用场景足够了。
第三,珍惜你的 API 配额。 Fable 5 的 Usage Credits 定价不会便宜,Kimi K3 即使"免费开放"也会有速率限制。把最强的模型用在最需要的地方——复杂推理、长程 Agent——普通任务用更便宜、更快的模型。
反思
一年前我们还在讨论"AI 什么时候变得太强",现在我们在讨论"AI 太强了以至于不够用了"。这个转向之快,所有人都没预料到。
AI 能力的供给瓶颈——不管是技术性的(算力不够)还是政策性的(出口管制)——将是接下来几年最重要的行业议题。
好消息是:竞争在加速。K2 发布一周后就是 K3。模型能力的军备竞赛没有减速的迹象。稀缺是暂时的,能力是增长的。
但在这个过渡期,开发者的策略需要从"尽情使用"转向"精明使用"。限量供应的不是 AI——是最好的 AI。
参考来源:
评论
评论已关闭。