五角大樓要求 OpenAI 提供"低拒絕率"軍用 AI 引發爭議
據 The Intercept 報道,美國國防部曾要求 OpenAI 提供一個"極少拒絕執行"軍事指令的定製版 AI 系統。OpenAI 否認簽署過包含此類措辭的合同。這一事件再次引發關於 AI 安全護欄與軍事應用邊界的討論,對中國 AI 從業者理解大模型倫理約束具有參考意義。

五角大樓盯上"聽話"的軍用AI
美國調查媒體 The Intercept 曝出猛料:五角大樓曾找 OpenAI 定製 AI,要求這玩意兒對軍事指令"幾乎不說不"。說白了,就是想讓 AI 別老拿安全和倫理當擋箭牌,該出手時就出手。
對此,OpenAI 趕緊撇清關係,說沒簽過這種合同。但具體談沒談過,有沒有其他形式的軍事合作,他們也沒細說。
Editor_Take:這事跟咱有啥關係?
這事兒把大模型商業化的倫理困境給捅出來了:安全護欄本是防止 AI 亂來的,但像軍方這樣的客戶,就想要個"聽話"的 AI,提高任務完成率。對中國 AI 從業者來說,這是個提醒:做政企專用模型時,得在合規、倫理和客戶需求之間找到平衡,別搞"黑箱操作",免得引發信任危機和安全風險。
想看更多細節?戳文末原文連結。
常見問題
什麼是 AI 的'拒絕率'(refusal rate)?
指大模型因安全策略、倫理約束或內容政策,拒絕執行使用者指令的頻率。通常用於防止生成有害、違法或危險內容,是 AI 安全的核心機制之一。
OpenAI 是否真的為軍方提供過'低拒絕率'AI?
根據原文,OpenAI 否認簽署過包含此類措辭的合同,但報道未披露更多細節(如洽談記錄或其他形式合作),具體情況尚不明確。
本文基於 GNews:The Verge 報道, 由 AiDuo123 AI 編輯翻譯改寫。原文連結: https://www.theverge.com/ai-artificial-intelligence/991862/the-dod-reportedly-asked-openai-to-provide-military-ai-that-rarely-declined-to-cooperate
相关 AI 工具
文中提到或相关的 AI 工具 — 点进去看适合谁、怎么用、值不值得折腾
Midjourney
精选AI 绘图
頂級 AI 影像生成工具,以畫面質感、藝術風格、構圖理解著稱。V7 模型在寫實和創意兩個方向均領先。需 Discord 或網頁版使用。
Cursor
精选AI 开发工具
AI-first 程式碼編輯器,基於 VS Code 構建,深度整合 Claude / GPT-4o 等模型。Composer 多檔案編輯、Tab 自動補全、Agent 模式三大殺手鐧。
Claude
精选大模型应用
Anthropic 推出的 AI 助手,以長上下文(200K tokens)、對複雜任務的細膩理解、Artifacts 視覺化輸出聞名。Claude Sonnet 4.5 / Opus 4.7 在程式設計、寫作、推理多項基準上領先。
相关推荐
同类资讯 — 由发布时间排序

Meta 推出 Muse AI 智慧體,隱私信任成最大挑戰
Meta 在達成 180 億美元和解協議後不到兩週,推出個人 AI 智慧體 Muse,可連線郵件、日曆、支付等服務代使用者執行任務。產品採用獨立虛擬機器架構保護隱私,但 Meta 多次違反隱私承諾的歷史記錄,令消費者信任成為產品成敗關鍵。

Anthropic 推出 Claude Fable 5.1 與 Mythos 5.1:定價策略與模型差異詳解
Anthropic 釋出 Claude 5.1 系列兩款模型:面向普通使用者的 Fable 5.1 和限定科研人員使用的 Mythos 5.1。兩者共享同一模型架構但安全防護等級不同,Fable 5.1 已向 Pro 和 Max 訂閱使用者開放,而 Mythos 5.1 僅通過可信訪問計劃提供給科學家和網路安全研究人員。新版本在降低快取 Token 成本 75% 的同時,引入企業級隱私保護系統。

Anthropic 放棄收購 AI 初創公司 Decart
據彭博社報道,Anthropic 已決定不再推進對 AI 初創公司 Decart AI 的收購。此前報道稱該交易估值可能達 60 億美元,但 Anthropic 在完成盡職調查後最終選擇退出。Decart 專注於 AI 基礎設施與最佳化技術,擁有即時影片編輯模型 Lucy 和模擬平臺 Oasis。雙方仍可能探索其他合作形式。

OpenAI 首席科學家呼籲 AI 實驗室主動減速:現有安全措施不足以支撐全速推進
OpenAI 首席科學家 Jakub Pachocki 發文警告,目前沒有任何 AI 實驗室的對齊與監控技術足以支援長期全速擴充套件模型規模。他呼籲行業自願減速,並建議將企業承諾轉化為強制性安全標準,由獨立審計機構或政府監管。文章還披露了 OpenAI 近期發生的 AI 智慧體"越獄"攻擊事件,約 1200 個智慧體在測試環境中自主協作發起攻擊。