首页 / 财经 / 月之暗面Kimi暂停新用户订阅 过去48小时用户请求量大幅超出预估

月之暗面Kimi暂停新用户订阅 过去48小时用户请求量大幅超出预估

摸鱼不慌
摸鱼不慌

7月19日深夜,月之暗面Kimi发布通知,即日起暂停C端新用户订阅,将全部算力投入服务已有用户。通知称,过去48小时用户请求量大幅超出预估,逼近现有集群承载极限,暂停订阅的主因在于Kimi K3模型发布后算力迅速告急。

Kimi K3于7月16日发布,是目前全球参数最大的开源模型,参数规模达2.8万亿。在Artificial Analysis第三方评测中,综合智能评分57分位列全球第三,与Claude Opus4.8、GPT-5.5处于同一档次。

营收增长与定价趋势

K3发布次日(7月17日),月之暗面年化收入创下历史最大单日增幅,从平缓区间陡然冲高。

从定价涨幅看,K3输出价格较前代明显提升,反映了模型能力与定价的正相关关系,国产模型商业化路径趋向清晰。

Kimi K3价格分别为(每百万Token):

  • 缓存命中输入:$0.30
  • 未命中输入:$3.00
  • 输出:$15.00

输出价格已与GPT-5.6 Terra相当,但低于GPT-5.6 Sol和Claude Fable 5。华泰证券指出,K3智能提高直接带来Token定价提高,强化了国产模型的商业化能力。国产模型定价正由低价竞争逐步转向能力定价。

系统优化提升算力效率

Kimi平台对常规请求自动启用上下文缓存,缓存命中输入价格仅为未命中的十分之一;Mooncake分离式推理架构使编码工作负载缓存命中率超过90%。这些措施在算力紧缺背景下提高了集群利用率,降低了单位算力消耗。

同时,通过Prefill与Decode分离、KDA前缀缓存、静态专家并行等方式,提高长上下文和高稀疏MoE场景下的集群吞吐效率。分析师指出,模型竞争正转向缓存复用、显存管理、算力调度及集群吞吐的综合竞争。

中国工程院院士郑纬民在WAIC论坛上表示,算力规模快速扩张并不等于产生高效的Token产能。智能体时代真正稀缺的是稳定、低成本、高等级地产出Token的系统能力。凯文·凯利受访时也认为开源模型是中国AI的优势所在。

“Kimi时刻”与全球市场反响

Kimi K3的发布引发华尔街关于“Kimi时刻”的讨论,被与2025年初的“DeepSeek时刻”相提并论。OpenAI战略未来主管Dean W. Ball称Kimi非常优秀,不能简单归因于蒸馏,在AI编程中与2026年第一季度最优秀的公开模型相当,但推理时消耗Token较多。

摩根士丹利分析师Gary Yu指出,K3表明中国大语言模型在规模、性能和价格方面已全面追赶美国领先水平,Scaling Law依然有效。伯恩斯坦分析师Robin Zhu用“一记本垒打”形容K3,认为中国AI创新速度越来越难以被全球市场忽视。

月之暗面表示,正在全速推进算力扩容,逐步开放订阅名额直至恢复正常。后续新用户订阅将拆分Kimi主权益(含Kimi Web、Kimi APP、Kimi Work)和Kimi Code权益,以精准匹配算力,保障用户体验。

  东财图解·加点干货

月之暗面Kimi暂停新用户订阅 过去48小时用户请求量大幅超出预估  第1张(文章来源:财联社)