阿里巴巴发布 Qwen3.8-Max 大模型,2.4 万亿参数对标月之暗面
阿里巴巴推出迄今最强 AI 模型 Qwen3.8-Max,拥有 2.4 万亿参数,采用混合专家架构(MoE)降低推理成本。该模型在 Arena.AI 平台成为中国排名最高的文本模型,在多模态视觉任务中全球排名第二,仅次于 Anthropic 的 Claude。模型支持百万 token 上下文窗口,将于下周通过阿里云模型工作室平台发布。

阿里巴巴发布史上最强模型,参数规模直追月之暗面
阿里巴巴于本周一发布了其迄今为止规模最大、能力最强的人工智能模型 Qwen3.8-Max。这款模型拥有 2.4 万亿参数,与国内竞争对手月之暗面(Moonshot AI)上月发布的 Kimi K3(2.8 万亿参数)规模相当接近。
参数是模型从数据中学习的数值设置,用于识别模式、生成答案和执行任务。虽然更高的参数量不一定直接等同于更好的性能,但它已成为衡量先进 AI 系统背后计算和数据规模的关键指标。中国科技公司通常热衷于公开参数量,以帮助其模型在开发者社区中获得关注——这与 OpenAI、Anthropic 和 Google 等不公开闭源模型参数的做法形成鲜明对比。
技术亮点:混合专家架构降低成本
Qwen3.8-Max 采用了 "混合专家"(Mixture-of-Experts, MoE) 架构设计。这种设计将工作分配给系统中的专业化部分,而不是为每个请求激活整个模型。据阿里巴巴介绍,该模型每次实际仅使用 950 亿参数,这大幅降低了运行成本和响应延迟。
在实际应用测试中,该模型在 16 天内完成了一个软件工程项目,展示了其在复杂任务中的实用性。
多模态能力与超长上下文支持
Qwen3.8-Max 和月之暗面的 Kimi K3 均支持 文本、图像和视频 处理,并能一次处理多达 100 万个 token。Token 是数据块(通常是单词的一部分或短单词),如此大的上下文窗口意味着模型可以一次性处理大量材料,例如长篇法律文件、大型软件代码库或数百页文档。
第三方平台排名表现亮眼
Qwen3.8-Max 在众包模型比较平台 Arena.AI 上首次亮相,立即成为 中国排名最高的文本模型。不过在全球排名中,它仍落后于 Anthropic 的 Claude Sonnet 5(原文为 Fable 5,疑为 Sonnet 5 误译)和三个 Opus 变体。
但在 Arena.AI 的 视觉材料分析模型排行榜 上,Qwen3.8-Max 排名 全球第二,仅次于 Claude Sonnet 5 的一个变体。这一成绩显示阿里在多模态能力上已具备国际竞争力。
中国大模型的开源策略
中国科技公司在全球开放权重(open-weight)AI 模型领域是一支重要力量。开放权重意味着允许开发者下载模型的底层学习设置,以便运行或调整系统。这与 OpenAI、Anthropic 等公司的闭源策略形成鲜明对比。
业内普遍认为,中国厂商通过开放权重模型争夺开发者生态,试图在激烈且快速变化的竞争中构建更强大的系统,同时避免运行成本过高的问题。
发布计划
Qwen3.8-Max 计划于 下周 通过阿里云的 Model Studio 平台 正式发布。届时开发者和企业用户将能够通过该平台访问和部署这一模型。
适合谁关注? 对大模型技术架构、中国 AI 竞争格局、多模态能力发展感兴趣的从业者和研究人员;需要处理超长文档或复杂视觉任务的企业开发者。
本文基于 GNews:Devdiscourse 报道, 由 AiDuo123 AI 编辑翻译改写。原文链接: https://www.devdiscourse.com/article/technology/3958630-alibaba-unveils-its-most-capable-ai-model-to-date-not-far-behind-moonshots-in-size
常见问题
- Qwen3.8-Max 的 2.4 万亿参数是什么意思?实际使用时真的需要这么多吗?
- 参数是模型从训练数据中学习的数值设置,用于识别模式和生成答案。2.4 万亿是模型的总参数规模,但 Qwen3.8-Max 采用混合专家(MoE)架构,实际推理时仅激活 950 亿参数,这样既保持了大模型的能力,又大幅降低了运行成本和响应延迟。这是目前大模型降本增效的主流技术路线之一。
- Qwen3.8-Max 与月之暗面 Kimi K3 相比有什么区别?
- 从原文披露的信息看,Kimi K3 参数量为 2.8 万亿,略高于 Qwen3.8-Max 的 2.4 万亿。两者都支持文本、图像、视频处理,并具备 100 万 token 的上下文窗口。但 Qwen3.8-Max 在 Arena.AI 平台的视觉任务排名上表现更突出(全球第二),具体性能差异需要等待更详细的技术报告或实测对比。
- 这个模型什么时候能用?普通开发者可以免费使用吗?
- 根据原文,Qwen3.8-Max 将于下周通过阿里云的 Model Studio 平台发布。至于是否免费,原文未提及具体定价策略。通常阿里云模型平台会提供免费试用额度,但大规模商业使用可能需要付费。建议关注阿里云官方发布的详细定价和使用条款。
- 开放权重模型和闭源模型对开发者有什么实际影响?
- 开放权重(open-weight)模型允许开发者下载模型参数并在本地或私有云环境中运行、微调和定制,适合对数据隐私、成本控制或深度定制有需求的场景。闭源模型(如 OpenAI GPT 系列)通常只能通过 API 调用,但往往在性能和易用性上有优势。中国厂商倾向于开放权重策略来吸引开发者生态,而美国头部公司更多采用闭源商业化路线。
相关 AI 工具
文中提到或相关的 AI 工具 — 点进去看适合谁、怎么用、值不值得折腾
Midjourney
精选AI 绘图
顶级 AI 图像生成工具,以画面质感、艺术风格、构图理解著称。V7 模型在写实和创意两个方向均领先。需 Discord 或网页版使用。
Cursor
精选AI 开发工具
AI-first 代码编辑器,基于 VS Code 构建,深度集成 Claude / GPT-4o 等模型。Composer 多文件编辑、Tab 自动补全、Agent 模式三大杀手锏。
Claude
精选大模型应用
Anthropic 推出的 AI 助手,以长上下文(200K tokens)、对复杂任务的细腻理解、Artifacts 可视化输出闻名。Claude Sonnet 4.5 / Opus 4.7 在编程、写作、推理多项基准上领先。
相关推荐
同类资讯 — 由发布时间排序

谷歌 AI Mode 升级旅行规划功能:支持航班价格追踪与酒店预订
谷歌宣布为其对话式搜索体验 AI Mode 新增旅行规划能力,用户可通过自然语言追踪航班价格、预订酒店,并查看积分/里程兑换成本。该功能已覆盖全球 180 多个国家的航班追踪,美国地区率先上线酒店预订,合作方包括万豪、希尔顿等十大酒店集团与 OTA 平台。

Anthropic 为何既不签授权协议也未被起诉?出版商揭秘背后策略
在主流 AI 公司纷纷与出版商签署内容授权协议或对簿公堂之际,Anthropic 成为唯一例外——既未公开达成任何授权交易,也未遭到数字出版商起诉。四位媒体高管和法律专家透露,这源于其坚守"合理使用"立场、企业级产品定位,以及微妙的时机把控。但随着 Anthropic 估值冲向 9650 亿美元并加速 IPO,其数据哲学可能重塑开放网络规则。

独立音乐版权方Round Hill起诉Suno与Anthropic 索赔超10亿美元
拥有11亿美元版权资产的独立音乐发行商Round Hill于2026年8月17日分别起诉AI音乐生成平台Suno和大语言模型公司Anthropic,指控两家公司未经授权抓取其版权音乐用于模型训练。诉讼索赔金额均超10亿美元,涉及歌曲包括《Total Eclipse of the Heart》等经典作品。Round Hill CEO明确表示不会和解,其代理律师曾赢得"Blurred Lines"版权案。
客户体验进入编排时代:AI 智能体如何摆脱遗留系统束缚
企业正加速部署 AI 智能体和语音 AI,但多数只是将对话式 AI 嫁接到遗留系统上,导致编排(Orchestration)成为新挑战。塔塔通信(Tata Communications)高管指出,真正的竞争优势不在于自动化本身,而在于如何通过共享上下文层协调 AI 系统、数据和人工座席,实现无缝的端到端客户体验。