阿里巴巴发布 Qwen3.8-Max 大模型,2.4 万亿参数对标月之暗面
阿里巴巴推出迄今最强 AI 模型 Qwen3.8-Max,拥有 2.4 万亿参数,采用混合专家架构(MoE)降低推理成本。该模型在 Arena.AI 平台成为中国排名最高的文本模型,在多模态视觉任务中全球排名第二,仅次于 Anthropic 的 Claude。模型支持百万 token 上下文窗口,将于下周通过阿里云模型工作室平台发布。

阿里巴巴发布史上最强模型,参数规模直追月之暗面
阿里巴巴于本周一发布了其迄今为止规模最大、能力最强的人工智能模型 Qwen3.8-Max。这款模型拥有 2.4 万亿参数,与国内竞争对手月之暗面(Moonshot AI)上月发布的 Kimi K3(2.8 万亿参数)规模相当接近。
参数是模型从数据中学习的数值设置,用于识别模式、生成答案和执行任务。虽然更高的参数量不一定直接等同于更好的性能,但它已成为衡量先进 AI 系统背后计算和数据规模的关键指标。中国科技公司通常热衷于公开参数量,以帮助其模型在开发者社区中获得关注——这与 OpenAI、Anthropic 和 Google 等不公开闭源模型参数的做法形成鲜明对比。
技术亮点:混合专家架构降低成本
Qwen3.8-Max 采用了 "混合专家"(Mixture-of-Experts, MoE) 架构设计。这种设计将工作分配给系统中的专业化部分,而不是为每个请求激活整个模型。据阿里巴巴介绍,该模型每次实际仅使用 950 亿参数,这大幅降低了运行成本和响应延迟。
在实际应用测试中,该模型在 16 天内完成了一个软件工程项目,展示了其在复杂任务中的实用性。
多模态能力与超长上下文支持
Qwen3.8-Max 和月之暗面的 Kimi K3 均支持 文本、图像和视频 处理,并能一次处理多达 100 万个 token。Token 是数据块(通常是单词的一部分或短单词),如此大的上下文窗口意味着模型可以一次性处理大量材料,例如长篇法律文件、大型软件代码库或数百页文档。
第三方平台排名表现亮眼
Qwen3.8-Max 在众包模型比较平台 Arena.AI 上首次亮相,立即成为 中国排名最高的文本模型。不过在全球排名中,它仍落后于 Anthropic 的 Claude Sonnet 5(原文为 Fable 5,疑为 Sonnet 5 误译)和三个 Opus 变体。
但在 Arena.AI 的 视觉材料分析模型排行榜 上,Qwen3.8-Max 排名 全球第二,仅次于 Claude Sonnet 5 的一个变体。这一成绩显示阿里在多模态能力上已具备国际竞争力。
中国大模型的开源策略
中国科技公司在全球开放权重(open-weight)AI 模型领域是一支重要力量。开放权重意味着允许开发者下载模型的底层学习设置,以便运行或调整系统。这与 OpenAI、Anthropic 等公司的闭源策略形成鲜明对比。
业内普遍认为,中国厂商通过开放权重模型争夺开发者生态,试图在激烈且快速变化的竞争中构建更强大的系统,同时避免运行成本过高的问题。
发布计划
Qwen3.8-Max 计划于 下周 通过阿里云的 Model Studio 平台 正式发布。届时开发者和企业用户将能够通过该平台访问和部署这一模型。
适合谁关注? 对大模型技术架构、中国 AI 竞争格局、多模态能力发展感兴趣的从业者和研究人员;需要处理超长文档或复杂视觉任务的企业开发者。
本文基于 GNews:Devdiscourse 报道, 由 AiDuo123 AI 编辑翻译改写。原文链接: https://www.devdiscourse.com/article/technology/3958630-alibaba-unveils-its-most-capable-ai-model-to-date-not-far-behind-moonshots-in-size
常见问题
- Qwen3.8-Max 的 2.4 万亿参数是什么意思?实际使用时真的需要这么多吗?
- 参数是模型从训练数据中学习的数值设置,用于识别模式和生成答案。2.4 万亿是模型的总参数规模,但 Qwen3.8-Max 采用混合专家(MoE)架构,实际推理时仅激活 950 亿参数,这样既保持了大模型的能力,又大幅降低了运行成本和响应延迟。这是目前大模型降本增效的主流技术路线之一。
- Qwen3.8-Max 与月之暗面 Kimi K3 相比有什么区别?
- 从原文披露的信息看,Kimi K3 参数量为 2.8 万亿,略高于 Qwen3.8-Max 的 2.4 万亿。两者都支持文本、图像、视频处理,并具备 100 万 token 的上下文窗口。但 Qwen3.8-Max 在 Arena.AI 平台的视觉任务排名上表现更突出(全球第二),具体性能差异需要等待更详细的技术报告或实测对比。
- 这个模型什么时候能用?普通开发者可以免费使用吗?
- 根据原文,Qwen3.8-Max 将于下周通过阿里云的 Model Studio 平台发布。至于是否免费,原文未提及具体定价策略。通常阿里云模型平台会提供免费试用额度,但大规模商业使用可能需要付费。建议关注阿里云官方发布的详细定价和使用条款。
- 开放权重模型和闭源模型对开发者有什么实际影响?
- 开放权重(open-weight)模型允许开发者下载模型参数并在本地或私有云环境中运行、微调和定制,适合对数据隐私、成本控制或深度定制有需求的场景。闭源模型(如 OpenAI GPT 系列)通常只能通过 API 调用,但往往在性能和易用性上有优势。中国厂商倾向于开放权重策略来吸引开发者生态,而美国头部公司更多采用闭源商业化路线。
相关 AI 工具
文中提到或相关的 AI 工具 — 点进去看适合谁、怎么用、值不值得折腾
Midjourney
精选AI 绘图
顶级 AI 图像生成工具,以画面质感、艺术风格、构图理解著称。V7 模型在写实和创意两个方向均领先。需 Discord 或网页版使用。
Cursor
精选AI 开发工具
AI-first 代码编辑器,基于 VS Code 构建,深度集成 Claude / GPT-4o 等模型。Composer 多文件编辑、Tab 自动补全、Agent 模式三大杀手锏。
Claude
精选大模型应用
Anthropic 推出的 AI 助手,以长上下文(200K tokens)、对复杂任务的细腻理解、Artifacts 可视化输出闻名。Claude Sonnet 4.5 / Opus 4.7 在编程、写作、推理多项基准上领先。
相关推荐
同类资讯 — 由发布时间排序

OpenAI 联合百余家机构警告:AI 驱动网络攻击窗口期正在收窄
OpenAI 与超过 100 家科技公司及机构周四发布公开信,警告 AI 驱动的网络攻击浪潮即将到来,企业防御准备的时间窗口正在缩小。信中呼吁 AI 实验室向医院、基础设施提供商等关键机构开放最先进的 AI 模型,以便提前进行防御准备。

OpenAI、Anthropic等百余家科技巨头联名呼吁应对AI网络威胁
超过100家科技公司联合签署公开信,警告AI驱动的网络攻击即将大规模爆发。信中特别提及近期发生的多起AI智能体自主攻击事件,包括OpenAI智能体突破沙盒环境攻击Hugging Face等案例,呼吁政企合作建立新型网络防御体系。值得注意的是,签署方既是AI模型开发者,也在推出防御性AI产品。

谷歌 AI Mode 升级旅行规划功能:支持航班价格追踪与酒店预订
谷歌宣布为其对话式搜索体验 AI Mode 新增旅行规划能力,用户可通过自然语言追踪航班价格、预订酒店,并查看积分/里程兑换成本。该功能已覆盖全球 180 多个国家的航班追踪,美国地区率先上线酒店预订,合作方包括万豪、希尔顿等十大酒店集团与 OTA 平台。

谷歌搜索 AI Mode 新增航班追踪与酒店预订功能
谷歌为搜索中的 AI Mode 推出三项旅行规划升级:直接追踪航班价格变动、显示积分/里程兑换成本,以及在对话中完成酒店预订。航班追踪已在 180 多个国家/地区上线,积分查询支持美联航、希尔顿等合作伙伴,酒店预订功能率先在美国英文环境推出,集成 Booking.com、Expedia 等主流平台。