资讯模型与产品··来源: Tribuneindia·原文 →

月之暗面 Kimi K3 訂閱因需求激增暫停 推出 2.8 萬億引數模型

中國 AI 初創公司月之暗面(Moonshot AI)宣佈暫停其最新模型 Kimi K3 的新使用者訂閱,原因是過去 48 小時需求激增導致算力接近極限。該公司正加速擴容並將分批重啟訂閱,同時計劃拆分會員體系以最佳化資源分配。Kimi K3 是全球首個開源 3T 級引數模型,擁有 2.8 萬億引數和 100 萬 token 上下文視窗。

月之暗面 Kimi K3 訂閱因需求激增暫停 推出 2.8 萬億引數模型
[广告位 · 上线后接 AdSense]

中國AI新銳月之暗面(Moonshot AI)最近攤上"幸福的煩惱"——剛推出的Kimi K3模型太火爆,直接暫停新使用者訂閱了。

算力告急:48小時被擠爆

月之暗面在官微上喊話:過去兩天使用者量直接頂到算力天花板。為了保證老鐵們的使用體驗,只能先關門謝客,把資源優先留給已付費使用者。"現有會員不受影響",官方特別強調。

團隊正在緊急擴容,承諾會分批重新開放註冊。這波操作在國內大模型圈相當少見,可見頭部玩家在使用者規模和燒錢速度之間找平衡有多難。

會員分家:精準匹配需求

為了應對算力壓力,月之暗面祭出新招——推出兩套會員體系

  • Kimi會員:覆蓋網頁版、App和Kimi Work
  • Kimi Code會員:專治程式設計師的各種需求

這波拆分就是要把算力用在刀刃上,避免寫程式碼的和普通使用者搶資源。對國內使用者來說選擇更靈活了,不過具體價格還是個謎。

Kimi K3硬核引數

作為當家花旦,Kimi K3的配置相當能打:

  • 2.8萬億引數,官方號稱"全球首個開源3T級模型"
  • 100萬token上下文視窗,長篇文件處理神器
  • 主打程式設計輔助、知識工作和複雜推理這些高階局

目前已經在Kimi全家桶(網頁/App/Work/Code/API)上線。預設開啟最強腦力模式,省電模式和狂暴模式後續會OTA升級。

最狠的是官方立下flag:2026年7月27日前必開源,給開發者吃了顆定心丸。

效能對標:承認差距但很能打

月之暗面在技術部落格裡很實在:Kimi K3確實達到了第一梯隊水平,但也坦白還幹不過Claude Fable 5和GPT 5.6 SoI(注:疑似未來版本代號)。

這波坦誠在國內AI圈相當罕見——不吹牛直接認慫,反而讓人更期待後續迭代。

國內使用者最關心的三點

對咱們開發者和企業來說,Kimi K3的香主要在:

  1. 100萬token上下文簡直是合同黨、論文黨的福音
  2. 開源承諾意味著以後部署能省不少錢(雖然要等到2026)
  3. 會員分家可能更省錢(不寫程式碼就不用為程式設計功能買單)

不過要注意,現在算力緊張可能導致服務抽風,API穩定性也有待考驗。

常見問題

Kimi K3 何時恢復新使用者訂閱?

月之暗面表示將分批次重新開放訂閱名額,但未給出具體時間表。建議關注官方社交媒體或 Kimi.com 公告。

2.8 萬億引數模型在國產大模型中處於什麼水平?

屬於國內頭部規模。通常認為,3T 級引數模型在複雜推理和長文本理解上具有優勢,但實際效能還取決於訓練資料質量和架構設計。Kimi K3 是首個公開宣佈的國產開源 3T 級模型。

Kimi Code Membership 適合哪些使用者?

專為程式設計場景設計,可能更適合需要頻繁程式碼生成、除錯或技術文件處理的開發者。若主要用於文本問答或辦公場景,通用 Kimi Membership 可能更經濟。

100 萬 token 上下文視窗意味著什麼?

可一次性處理約 75 萬漢字(token 數與字元數比例因語言而異)。實際應用中,能完整讀入一本中篇小說或數十頁技術文件,適合需要全域性理解的任務。

模型權重開源後能否本地部署?

理論上可以,但 2.8T 引數模型對硬體要求極高(通常需要多卡 GPU 叢集)。中小企業更可能通過 API 或雲服務使用,完全本地部署成本較高。


本文基於 GNews:The Tribune 報道, 由 AiDuo123 AI 編輯翻譯改寫。原文連結: https://www.tribuneindia.com/news/business/chinas-moonshot-ai-pauses-new-kimi-k3-subscriptions-amid-surge-in-demand/

[广告位 · 上线后接 AdSense]
标签:#Anthropic

相关 AI 工具

文中提到或相关的 AI 工具 — 点进去看适合谁、怎么用、值不值得折腾

浏览全部工具 →

同类资讯 — 由发布时间排序

蘋果手錶新 AI 功能引爭議:環境錄音與隱私的邊界在哪裡

蘋果手錶新 AI 功能引爭議:環境錄音與隱私的邊界在哪裡

蘋果在最新發佈會上為 Apple Watch 引入了 Live Rewind 和 Siri Recap 等即時音訊轉錄功能,允許使用者回溯 15 秒對話並自動生成會議摘要。儘管蘋果強調不儲存原始音訊且支援端到端加密,但這些"始終聆聽"的技術仍引發了關於同意權、法律證據效力及社交行為改變的廣泛討論,標誌著科技巨頭在 AI 競爭壓力下對隱私底線的重新定義。

应用与案例AI 安全
WIRED 編輯實測:我讓 AI 駭客代理掃描家庭網路,發現了什麼

WIRED 編輯實測:我讓 AI 駭客代理掃描家庭網路,發現了什麼

WIRED 專欄作者親身測試去安全對齊的 AI 模型,使用 Abliteration AI 提供的改造版 GLM-5.3 掃描家庭網路。實驗發現印表機配置漏洞、智慧音箱資訊洩露等十餘處安全隱患,但同時也獲得了實用的加固建議。這場"以毒攻毒"的實驗揭示:AI 駭客工具既是威脅,也可能成為普通使用者的防禦武器。

应用与案例AI 安全
ControlAI 執行董事:超級智慧不是武器而是對手,應立法禁止開發

ControlAI 執行董事:超級智慧不是武器而是對手,應立法禁止開發

AI 安全非營利組織 ControlAI 美國執行董事 Connor Leahy 在 TechCrunch 播客中提出激進觀點:應通過立法完全禁止企業開發超級智慧(superintelligence),而非僅依賴對齊與遏制技術。他認為當 AI 能自主改進 AI 時將觸發失控迴圈,並透露美英兩國已有相關立法推進,包括 Sanders-Casar 提出的"禁止超級智慧法案"。

政策与安全OpenAI
五角大樓要求 OpenAI 提供"低拒絕率"軍用 AI 引發爭議

五角大樓要求 OpenAI 提供"低拒絕率"軍用 AI 引發爭議

據 The Intercept 報道,美國國防部曾要求 OpenAI 提供一個"極少拒絕執行"軍事指令的定製版 AI 系統。OpenAI 否認簽署過包含此類措辭的合同。這一事件再次引發關於 AI 安全護欄與軍事應用邊界的討論,對中國 AI 從業者理解大模型倫理約束具有參考意義。

政策与安全OpenAI