2026-07-20_AI_Kimi因算力瓶頸暫停新訂閱
Kimi 因算力瓶頸暫停新訂閱
☘️ Article
孟恭觀點
- kimi:暫停新訂閱,並把算力優先提供給老客人
- 跟 ds 事件滿類似,用量更大滲透更廣,公司出來說算力不夠的同時,市場卻在爭論算力要過剩了
✍️ Abstract
Kimi 因算力瓶頸暫停新訂閱
- 需求超載:Kimi K3 需求遠超預期,GPU 負載沉重。
- 暫停新訂閱:過去 48 小時需求逼近容量上限,為保護現有訂閱者,暫停新訂閱。
- 擴充容量:官方正加速擴充容量,未來將分批重新開放訂閱。
- 方案拆分:訂閱方案將拆分為 一般用途的 Kimi Membership、程式開發專用的 Kimi Code Membership,以精準匹配算力需求。
孟恭觀點分析
- 保障老客體驗:Kimi 暫停新訂閱,將算力優先提供給現有客人。
- 記憶體消耗龐大:MoE 架構省運算,但不省記憶體,2.8T 參數原生權重達 1.4TB。
- 硬體用量提升:KV cache 刻意疏散至伺服器 DRAM、SSD,理論用量增加。
- 運算需求不減:K3 主打 Agentic,雲端沙盒頻繁執行 工具、程式碼,CPU 增量未改變。
- 算力瓶頸浮現:公司因撞到 capacity 上限,而發布公告。
- 市場認知落差:情況類似 DeepSeek 事件,實際用量龐大導致算力不足,市場卻在爭論算力過剩。
專有名詞
- MoE:Mixture of Experts (混合專家模型),一種神經網路架構。
- KV cache:大語言模型中用於加速推論的快取記憶體技術。
- Agentic:具備自主代理能力的 AI 系統,能執行各種 工具、程式碼。
- DeepSeek:中國人工智慧公司,及其推出的大語言模型。
