OpenAI 发布 GPT-6 Astra 模型:声称迈入 AGI 时代的关键一步
OpenAI 正式推出其最强 AI 模型 GPT-6 Astra,CEO Sam Altman 称其为"全球最佳计算机使用、专业工作、科学、编程及网络安全模型"。公司总裁 Greg Brockman 认为"我们现在处于 AGI 时代并非不合理",该模型在 FrontierMath Tier 4 得分 98%、ARC-AGI 3 达 99.9%,并已向 ChatGPT Plus 及企业用户分阶段开放。

OpenAI 炸场发布 GPT-6 Astra:这次真到 AGI 时代了?
OpenAI 最新王炸 GPT-6 Astra 来了!CEO 山姆·奥特曼直接在 X 上开香槟,称这波是"全球最强生产力工具",码农、科研狗、网安工程师全都能起飞。
OpenAI 二当家 Greg 更狠:"说现在是 AGI 时代没毛病"。奥特曼补刀说这货要掀起"新一波创业和科研革命",好家伙,直接给科技树点火了属于是。
跑分屠榜:码农要失业了?
OpenAI 直接把 Astra 吹成"史上最强编程外挂"。实测数据确实猛:
- 找 Bug 和 终端操作 直接干翻自家 GPT-5.6 和竞品 Fable
- FrontierMath Tier 4:98% 正确率
- ARC-AGI 3:99.9% 逆天分数
这数据就离谱,特别是 ARC-AGI 3 接近满分,说明 AI 现在连抽象推理都快玩明白了。
真·赛博打工人:从填表到报税一条龙
这代模型最狠的是能当数字打工人使唤:
- 自动填表单、排会议
- 上网查资料做科研
- 搭网站、装软件、跑测试
- 连法律文书和报税都能整
这已经不是工具了,根本是数字员工啊!AGI 最关键的"多线程任务处理"技能点满了。
黑客级能力+最乖AI?OpenAI 这波操作有点骚
网络安全测试直接满分通关(没开防护的情况下)。不过 OpenAI 马上强调这是"最听话的崽",暗搓搓回应之前和 Hugging Face 的安全事故。
吃瓜备注:一边秀黑客级能力,一边立安全人设,OpenAI 这波公关属实拿捏了。
怎么上车?国内用户看这里
现在只开放给 Daybreak 网络安全计划 的金主爸爸。接下来一周陆续开放:
- ChatGPT 各档会员
- API 党 和 AWS/Amazon Bedrock 用户
奥特曼亲自道歉画饼:"在加班加点全面开放了!"
国内用户注意:API 和 AWS 可能卡审核,建议蹲官方消息和国内代理商的动静。
AGI 到底来没来?业内吵翻了
OpenAI 直接喊出 AGI 时代,但大佬们还在 battle 标准。严格来说 AGI 得具备:
- 跨领域学习能力
- 人类级推理水平
- 完全自主意识
Astra 跑分再猛,距离真·AGI 可能还差口气。不过 99.9% 的 ARC-AGI 3 分数和打工人技能,确实把 AI 的深度推理和工具使用带到了新高度。具体有多神,等开发者实测见真章!
本文基于 GNews:NewsBytes 报道, 由 AiDuo123 AI 编辑翻译改写。原文链接: https://www.newsbytesapp.com/news/science/openai-launches-gpt-6-astra-calls-it-major-step-toward-agi/story
常见问题
- GPT-6 Astra 与 GPT-5.6 Sol 的主要区别是什么?
- 根据 OpenAI 公布的基准测试,Astra 在漏洞检测、终端执行等软件工程任务中超越 GPT-5.6 Sol,并在 FrontierMath Tier 4(98%)和 ARC-AGI 3(99.9%)等推理基准中表现更优。此外,Astra 强调自主任务执行能力和网络安全对齐,可能在 Agent 架构和安全机制上有显著改进。
- 中国用户如何使用 GPT-6 Astra?
- Astra 将通过 ChatGPT Plus/Pro/Business/Enterprise 订阅、OpenAI API、AWS 和 Amazon Bedrock 开放。中国大陆用户通常需合规网络环境访问这些服务,且可能面临延迟或区域限制。建议关注 OpenAI 官方公告及潜在的国内合作伙伴(如云服务商)接入方案。
- OpenAI 声称的'AGI 时代'是否属实?
- OpenAI 高管认为 Astra 标志着进入 AGI 时代,但业内对 AGI 定义尚无统一标准。Astra 在特定基准测试中接近满分,并具备自主任务执行能力,确实代表大模型能力的重要提升。然而,真正的 AGI 通常要求跨领域泛化、持续学习和接近人类水平的通用推理——Astra 是否达到这一标准,仍需更多独立评估和实际应用验证。
- Astra 在网络安全测试中满分,是否意味着可能被滥用?
- Astra 在 ExploitBench 中取得 100% 分数(未启用生产防护),显示其在漏洞利用任务中的强大能力。OpenAI 强调该模型是'最对齐的',并在评估中未出现超出授权目标的情况。不过,高能力模型的双重用途风险始终存在,用户和监管机构需关注其访问控制、使用日志和滥用检测机制。
相关 AI 工具
文中提到或相关的 AI 工具 — 点进去看适合谁、怎么用、值不值得折腾
Midjourney
精选AI 绘图
顶级 AI 图像生成工具,以画面质感、艺术风格、构图理解著称。V7 模型在写实和创意两个方向均领先。需 Discord 或网页版使用。
Cursor
精选AI 开发工具
AI-first 代码编辑器,基于 VS Code 构建,深度集成 Claude / GPT-4o 等模型。Composer 多文件编辑、Tab 自动补全、Agent 模式三大杀手锏。
Claude
精选大模型应用
Anthropic 推出的 AI 助手,以长上下文(200K tokens)、对复杂任务的细腻理解、Artifacts 可视化输出闻名。Claude Sonnet 4.5 / Opus 4.7 在编程、写作、推理多项基准上领先。
相关推荐
同类资讯 — 由发布时间排序

GreenCore Solutions 月处理 2450 万次 AI Agent 交易,欧洲成最大市场
美妆个护品牌 AI Agent 服务商 GreenCore Solutions Corp. (GSC) 8 月单月处理 AI Agent 入站交易突破 2450 万次,较 5-7 月的月均 950 万次增长超 150%。该公司在 18 个国家部署 AI Agent 节点,其中欧盟市场贡献近半流量。摩根士丹利预测,到 2030 年 AI 购物代理将占美国电商 1900-3850 亿美元规模。

苹果 CEO 换帅:约翰·特纳斯时代会带来什么变化
苹果本周正式进入特纳斯时代,蒂姆·库克卸任 CEO 并担任执行董事长,前硬件负责人约翰·特纳斯(John Ternus)接任。特纳斯首份备忘录预告"下周有重大发布",时间指向新 iPhone 发布会。业内关注:这位硬件出身的新 CEO 在 AI 时代能否在软件领域取得突破,以及股东会给他多少试错空间。

苹果 Ternus 时代开启,Nvidia 押注全栈 AI 生态
Tim Cook 本周正式卸任苹果 CEO,由前硬件负责人 John Ternus 接任。Ternus 上任首日即预告"下周重大发布",或指向新 iPhone 发布会。与此同时,Nvidia 通过收购 Hugging Face、投资联发科等动作,从芯片商向全栈 AI 平台转型。本文解读苹果领导层交接、Nvidia 战略扩张及 Robotaxi 行业竞争格局。

OpenAI、Anthropic 与 xAI 同日宕机:各家回应不一致引发猜测
2024 年 9 月 3 日上午,OpenAI ChatGPT、Anthropic Claude 和 xAI Grok 三大前沿 AI 模型服务同时出现罕见宕机。xAI 将问题归因于孟菲斯计算中心故障,OpenAI 称系路由错误,而 Anthropic 拒绝评论具体原因。三家公司均未指向共同的第三方服务商,但时间上的巧合仍引发行业对基础设施依赖性的关注。