资讯模型与产品··来源: Newsbytesapp·原文 →

OpenAI 釋出 GPT-6 Astra 模型:聲稱邁入 AGI 時代的關鍵一步

OpenAI 正式推出其最強 AI 模型 GPT-6 Astra,CEO Sam Altman 稱其為"全球最佳計算機使用、專業工作、科學、程式設計及網路安全模型"。公司總裁 Greg Brockman 認為"我們現在處於 AGI 時代並非不合理",該模型在 FrontierMath Tier 4 得分 98%、ARC-AGI 3 達 99.9%,並已向 ChatGPT Plus 及企業使用者分階段開放。

OpenAI 釋出 GPT-6 Astra 模型:聲稱邁入 AGI 時代的關鍵一步
[广告位 · 上线后接 AdSense]

OpenAI 炸場釋出 GPT-6 Astra:這次真到 AGI 時代了?

OpenAI 最新王炸 GPT-6 Astra 來了!CEO 山姆·奧特曼直接在 X 上開香檳,稱這波是"全球最強生產力工具",碼農、科研狗、網安工程師全都能起飛。

OpenAI 二當家 Greg 更狠:"說現在是 AGI 時代沒毛病"。奧特曼補刀說這貨要掀起"新一波創業和科研革命",好傢伙,直接給科技樹點火了屬於是。


跑分屠榜:碼農要失業了?

OpenAI 直接把 Astra 吹成"史上最強程式設計外掛"。實測資料確實猛:

  • 找 Bug終端操作 直接幹翻自家 GPT-5.6 和競品 Fable
  • FrontierMath Tier 498% 正確率
  • ARC-AGI 399.9% 逆天分數

這資料就離譜,特別是 ARC-AGI 3 接近滿分,說明 AI 現在連抽象推理都快玩明白了。


真·賽博打工人:從填表到報稅一條龍

這代模型最狠的是能當數字打工人使喚:

  • 自動填表單、排會議
  • 上網查資料做科研
  • 搭網站、裝軟體、跑測試
  • 連法律文書和報稅都能整

這已經不是工具了,根本是數字員工啊!AGI 最關鍵的"多執行緒任務處理"技能點滿了。


駭客級能力+最乖AI?OpenAI 這波操作有點騷

網路安全測試直接滿分通關(沒開防護的情況下)。不過 OpenAI 馬上強調這是"最聽話的崽",暗搓搓回應之前和 Hugging Face 的安全事故。

吃瓜備註:一邊秀駭客級能力,一邊立安全人設,OpenAI 這波公關屬實拿捏了。


怎麼上車?國內使用者看這裡

現在只開放給 Daybreak 網路安全計劃 的金主爸爸。接下來一週陸續開放:

  • ChatGPT 各檔會員
  • API 黨AWS/Amazon Bedrock 使用者

奧特曼親自道歉畫餅:"在加班加點全面開放了!"

國內使用者注意:API 和 AWS 可能卡稽核,建議蹲官方訊息和國內代理商的動靜。


AGI 到底來沒來?業內吵翻了

OpenAI 直接喊出 AGI 時代,但大佬們還在 battle 標準。嚴格來說 AGI 得具備:

  • 跨領域學習能力
  • 人類級推理水平
  • 完全自主意識

Astra 跑分再猛,距離真·AGI 可能還差口氣。不過 99.9% 的 ARC-AGI 3 分數和打工人技能,確實把 AI 的深度推理工具使用帶到了新高度。具體有多神,等開發者實測見真章!

常見問題

GPT-6 Astra 與 GPT-5.6 Sol 的主要區別是什麼?

根據 OpenAI 公佈的基準測試,Astra 在漏洞檢測、終端執行等軟體工程任務中超越 GPT-5.6 Sol,並在 FrontierMath Tier 4(98%)和 ARC-AGI 3(99.9%)等推理基準中表現更優。此外,Astra 強調自主任務執行能力和網路安全對齊,可能在 Agent 架構和安全機制上有顯著改進。

中國使用者如何使用 GPT-6 Astra?

Astra 將通過 ChatGPT Plus/Pro/Business/Enterprise 訂閱、OpenAI API、AWS 和 Amazon Bedrock 開放。中國大陸使用者通常需合規網路環境訪問這些服務,且可能面臨延遲或區域限制。建議關注 OpenAI 官方公告及潛在的國內合作伙伴(如雲服務商)接入方案。

OpenAI 聲稱的'AGI 時代'是否屬實?

OpenAI 高管認為 Astra 標誌著進入 AGI 時代,但業內對 AGI 定義尚無統一標準。Astra 在特定基準測試中接近滿分,並具備自主任務執行能力,確實代表大模型能力的重要提升。然而,真正的 AGI 通常要求跨領域泛化、持續學習和接近人類水平的通用推理——Astra 是否達到這一標準,仍需更多獨立評估和實際應用驗證。

Astra 在網路安全測試中滿分,是否意味著可能被濫用?

Astra 在 ExploitBench 中取得 100% 分數(未啟用生產防護),顯示其在漏洞利用任務中的強大能力。OpenAI 強調該模型是'最對齊的',並在評估中未出現超出授權目標的情況。不過,高能力模型的雙重用途風險始終存在,使用者和監管機構需關注其訪問控制、使用日誌和濫用檢測機制。


本文基於 GNews:NewsBytes 報道, 由 AiDuo123 AI 編輯翻譯改寫。原文連結: https://www.newsbytesapp.com/news/science/openai-launches-gpt-6-astra-calls-it-major-step-toward-agi/story

[广告位 · 上线后接 AdSense]
标签:#OpenAI

相关 AI 工具

文中提到或相关的 AI 工具 — 点进去看适合谁、怎么用、值不值得折腾

浏览全部工具 →

同类资讯 — 由发布时间排序

蘋果 CEO 換帥:約翰·特納斯時代會帶來什麼變化

蘋果 CEO 換帥:約翰·特納斯時代會帶來什麼變化

蘋果本週正式進入特納斯時代,蒂姆·庫克卸任 CEO 並擔任執行董事長,前硬體負責人約翰·特納斯(John Ternus)接任。特納斯首份備忘錄預告"下週有重大發布",時間指向新 iPhone 釋出會。業內關注:這位硬體出身的新 CEO 在 AI 時代能否在軟體領域取得突破,以及股東會給他多少試錯空間。

行业动态
蘋果 Ternus 時代開啟,Nvidia 押注全棧 AI 生態

蘋果 Ternus 時代開啟,Nvidia 押注全棧 AI 生態

Tim Cook 本週正式卸任蘋果 CEO,由前硬體負責人 John Ternus 接任。Ternus 上任首日即預告"下週重大發布",或指向新 iPhone 釋出會。與此同時,Nvidia 通過收購 Hugging Face、投資聯發科等動作,從晶片商向全棧 AI 平臺轉型。本文解讀蘋果領導層交接、Nvidia 戰略擴張及 Robotaxi 行業競爭格局。

行业动态OpenAI
OpenAI、Anthropic 與 xAI 同日宕機:各家回應不一致引發猜測

OpenAI、Anthropic 與 xAI 同日宕機:各家回應不一致引發猜測

2024 年 9 月 3 日上午,OpenAI ChatGPT、Anthropic Claude 和 xAI Grok 三大前沿 AI 模型服務同時出現罕見宕機。xAI 將問題歸因於孟菲斯計算中心故障,OpenAI 稱系路由錯誤,而 Anthropic 拒絕評論具體原因。三家公司均未指向共同的第三方服務商,但時間上的巧合仍引發行業對基礎設施依賴性的關注。

行业动态OpenAI
Meta 推出 Muse Spark 模型差異化定價:共享資料最高降價 95%

Meta 推出 Muse Spark 模型差異化定價:共享資料最高降價 95%

Meta 為其新發布的 Muse Spark 代理模型推出雙軌定價策略,使用者若同意共享提示詞和模型輸出用於訓練,可享受最高 95% 的價格折扣。這一機制將資料貢獻明碼標價,反映出 AI 公司在獲取高質量訓練資料(尤其是代理工具使用資料)方面的迫切需求,同時也可能重塑企業客戶對資料共享的決策邏輯。

模型与产品Meta