月之暗面 Kimi K3 订阅因需求激增暂停 推出 2.8 万亿参数模型
中国 AI 初创公司月之暗面(Moonshot AI)宣布暂停其最新模型 Kimi K3 的新用户订阅,原因是过去 48 小时需求激增导致算力接近极限。该公司正加速扩容并将分批重启订阅,同时计划拆分会员体系以优化资源分配。Kimi K3 是全球首个开源 3T 级参数模型,拥有 2.8 万亿参数和 100 万 token 上下文窗口。

中国AI新锐月之暗面(Moonshot AI)最近摊上"幸福的烦恼"——刚推出的Kimi K3模型太火爆,直接暂停新用户订阅了。
算力告急:48小时被挤爆
月之暗面在官微上喊话:过去两天用户量直接顶到算力天花板。为了保证老铁们的使用体验,只能先关门谢客,把资源优先留给已付费用户。"现有会员不受影响",官方特别强调。
团队正在紧急扩容,承诺会分批重新开放注册。这波操作在国内大模型圈相当少见,可见头部玩家在用户规模和烧钱速度之间找平衡有多难。
会员分家:精准匹配需求
为了应对算力压力,月之暗面祭出新招——推出两套会员体系:
- Kimi会员:覆盖网页版、App和Kimi Work
- Kimi Code会员:专治程序员的各种需求
这波拆分就是要把算力用在刀刃上,避免写代码的和普通用户抢资源。对国内用户来说选择更灵活了,不过具体价格还是个谜。
Kimi K3硬核参数
作为当家花旦,Kimi K3的配置相当能打:
- 2.8万亿参数,官方号称"全球首个开源3T级模型"
- 100万token上下文窗口,长篇文档处理神器
- 主打编程辅助、知识工作和复杂推理这些高端局
目前已经在Kimi全家桶(网页/App/Work/Code/API)上线。默认开启最强脑力模式,省电模式和狂暴模式后续会OTA升级。
最狠的是官方立下flag:2026年7月27日前必开源,给开发者吃了颗定心丸。
性能对标:承认差距但很能打
月之暗面在技术博客里很实在:Kimi K3确实达到了第一梯队水平,但也坦白还干不过Claude Fable 5和GPT 5.6 SoI(注:疑似未来版本代号)。
这波坦诚在国内AI圈相当罕见——不吹牛直接认怂,反而让人更期待后续迭代。
国内用户最关心的三点
对咱们开发者和企业来说,Kimi K3的香主要在:
- 100万token上下文简直是合同党、论文党的福音
- 开源承诺意味着以后部署能省不少钱(虽然要等到2026)
- 会员分家可能更省钱(不写代码就不用为编程功能买单)
不过要注意,现在算力紧张可能导致服务抽风,API稳定性也有待考验。
本文基于 GNews:The Tribune 报道, 由 AiDuo123 AI 编辑翻译改写。原文链接: https://www.tribuneindia.com/news/business/chinas-moonshot-ai-pauses-new-kimi-k3-subscriptions-amid-surge-in-demand/
常见问题
- Kimi K3 何时恢复新用户订阅?
- 月之暗面表示将分批次重新开放订阅名额,但未给出具体时间表。建议关注官方社交媒体或 Kimi.com 公告。
- 2.8 万亿参数模型在国产大模型中处于什么水平?
- 属于国内头部规模。通常认为,3T 级参数模型在复杂推理和长文本理解上具有优势,但实际性能还取决于训练数据质量和架构设计。Kimi K3 是首个公开宣布的国产开源 3T 级模型。
- Kimi Code Membership 适合哪些用户?
- 专为编程场景设计,可能更适合需要频繁代码生成、调试或技术文档处理的开发者。若主要用于文本问答或办公场景,通用 Kimi Membership 可能更经济。
- 100 万 token 上下文窗口意味着什么?
- 可一次性处理约 75 万汉字(token 数与字符数比例因语言而异)。实际应用中,能完整读入一本中篇小说或数十页技术文档,适合需要全局理解的任务。
- 模型权重开源后能否本地部署?
- 理论上可以,但 2.8T 参数模型对硬件要求极高(通常需要多卡 GPU 集群)。中小企业更可能通过 API 或云服务使用,完全本地部署成本较高。
相关 AI 工具
文中提到或相关的 AI 工具 — 点进去看适合谁、怎么用、值不值得折腾
Midjourney
精选AI 绘图
顶级 AI 图像生成工具,以画面质感、艺术风格、构图理解著称。V7 模型在写实和创意两个方向均领先。需 Discord 或网页版使用。
Cursor
精选AI 开发工具
AI-first 代码编辑器,基于 VS Code 构建,深度集成 Claude / GPT-4o 等模型。Composer 多文件编辑、Tab 自动补全、Agent 模式三大杀手锏。
Claude
精选大模型应用
Anthropic 推出的 AI 助手,以长上下文(200K tokens)、对复杂任务的细腻理解、Artifacts 可视化输出闻名。Claude Sonnet 4.5 / Opus 4.7 在编程、写作、推理多项基准上领先。
相关推荐
同类资讯 — 由发布时间排序

苹果手表新 AI 功能引争议:环境录音与隐私的边界在哪里
苹果在最新发布会上为 Apple Watch 引入了 Live Rewind 和 Siri Recap 等实时音频转录功能,允许用户回溯 15 秒对话并自动生成会议摘要。尽管苹果强调不存储原始音频且支持端到端加密,但这些"始终聆听"的技术仍引发了关于同意权、法律证据效力及社交行为改变的广泛讨论,标志着科技巨头在 AI 竞争压力下对隐私底线的重新定义。

WIRED 编辑实测:我让 AI 黑客代理扫描家庭网络,发现了什么
WIRED 专栏作者亲身测试去安全对齐的 AI 模型,使用 Abliteration AI 提供的改造版 GLM-5.3 扫描家庭网络。实验发现打印机配置漏洞、智能音箱信息泄露等十余处安全隐患,但同时也获得了实用的加固建议。这场"以毒攻毒"的实验揭示:AI 黑客工具既是威胁,也可能成为普通用户的防御武器。

ControlAI 执行董事:超级智能不是武器而是对手,应立法禁止开发
AI 安全非营利组织 ControlAI 美国执行董事 Connor Leahy 在 TechCrunch 播客中提出激进观点:应通过立法完全禁止企业开发超级智能(superintelligence),而非仅依赖对齐与遏制技术。他认为当 AI 能自主改进 AI 时将触发失控循环,并透露美英两国已有相关立法推进,包括 Sanders-Casar 提出的"禁止超级智能法案"。

五角大楼要求 OpenAI 提供"低拒绝率"军用 AI 引发争议
据 The Intercept 报道,美国国防部曾要求 OpenAI 提供一个"极少拒绝执行"军事指令的定制版 AI 系统。OpenAI 否认签署过包含此类措辞的合同。这一事件再次引发关于 AI 安全护栏与军事应用边界的讨论,对中国 AI 从业者理解大模型伦理约束具有参考意义。