Kimi暂停新会员,AI订阅制开始按算力分层
Kimi K3发布后,需求在48小时内逼近现有容量上限。月之暗面宣布暂停新会员,优先保障老用户,同时准备把会员拆成两类:一类服务网页、App和Work,一类专门服务编程工作流。
这这说明,大模型的“统一包月”正在失效。
过去的软件会员,用户多用几次,边际成本通常很低。大模型不同。一次简单问答、一次百万token长文处理、一个连续运行十几分钟的编程任务,对GPU时间、显存和输出token的消耗完全不是一个量级。K3虽然采用MoE架构,每次只激活896个专家中的16个,月之暗面称相对K2的整体扩展效率提升约2.5倍,但效率提升很快会被更复杂、更高频的任务消化。
暂停拉新只是表面动作,拆分会员才是长期信号。
消费级问答与编程Agent混在同一个资源池里,轻度用户会补贴重度用户,高峰期又会互相争抢容量。分开套餐后,公司可以设置不同的并发、配额、响应优先级和价格,用户也会逐渐从“每月能问多少次”,转向判断“我的任务能稳定拿到多少算力”。
模型公司不能只用低价包月换增长,再把拥堵留给老用户;开发者也不能把不限量当作长期承诺。下一阶段的竞争,除了模型能力,还包括容量规划、任务调度和价格设计。谁能让用户清楚知道自己买到了什么,并在高峰期兑现,谁才有机会把一次发布热度变成长期收入。
AI会员卖的不是账号入口,而是一份有边界的计算资源承诺。真正成熟的产品,必须把这份承诺算清楚。
