從「回答問題」到「接管工作」:OpenAI 推出 GPT-6 Astra,宣告執行型代理時代來臨(AGI時代)

舊金山訊 —— OpenAI 於 2026 年 9 月 3 日正式揭曉新一代旗艦模型「GPT-6 Astra」。這次發布不僅代表產品代號跨入「6」字頭,更象徵生成式 AI 的戰略軸線全面轉向:AI 正在擺脫過去單純「聊天、寫文、給建議」的被動定位,大步跨入能自行操作電腦、跨軟體執行複雜任務的「執行型代理(Action Agent)」時代。

不只會說、更要會做:Astra 直攻 Computer Use

GPT-6 Astra 最受市場矚目的核心突破,在於直接賦予模型原生「電腦操作(Computer Use)」能力。使用者不再需要事必躬親地將工作拆成多道 prompt,而是可以直接丟出終極目標——例如「整理這三家競爭對手的財報與產品線差異,做成一份主管會議用的簡報」。

接獲指令後,Astra 能在背後自主規劃步驟:

  • 跨軟體操作: 自行開啟瀏覽器檢索資料、填寫線上表單、更新企業 CRM,或同步行事曆。
  • 端到端交付: 完成資料運算、建立試算表、產生視覺化圖表,甚至搭建展示網站並執行前端 QA 驗證。

在效能指標上,OpenAI 公布的數據顯示,Astra 在模擬實際作業系統環境的 OSWorld 2.0 測試達到 72.6%(前代 GPT-5.6 Sol 為 65.7%),且平均任務耗時自 75 分鐘腰斬至 40 分鐘左右;搭配最新 Codex 架構後,在 Mind2Web 的工作速度更衝上 GPT-5.6 Sol 的 1.9 倍。這意味著 AI 評估標準已從「答得有多漂亮」,正式轉向「任務完成速度與成功率」。

算力版圖與 API 成本:算帳邏輯徹底改變

面對功能大幅躍進的旗艦款,Astra 的 API 定價也回升到高階水準

模型型號Input(每百萬 Tokens)Output(每百萬 Tokens)
GPT-5.6 Sol(原始標準價)US$5US$30
GPT-6 Astra(Standard)US$10US$50

雖然單看每百萬 Token 的標價,Astra 明顯高於陸續降價普及化的 GPT-5.6 系列(如 Terra 與 Luna),但企業端在 Agent 時代的算帳邏輯正發生質變。

過往單純比較 Token 單價,現在則必須看「單一任務交付的總成本」——這涵蓋了重試次數、呼叫次數與人工介入修正的時間。如果 Astra 能一次跑完流程、減少失敗率,高階模型的綜合商業成本反而更低。

而在硬體端,伴隨 OpenAI「Stargate」等數千億美元級基礎設施持續推進,GPU、HBM、先進封裝(如 CoWoS)與高速網路的需求依然是支撐 Agent 長期運作的骨幹。

AGI 真的來了嗎?強大自主性引發資安嚴管

Astra 的強悍表現讓 OpenAI 共同創辦人暨總裁 Greg Brockman 樂觀直言:未來回顧 AGI(通用人工智慧)的起點,「答案可能就是現在,甚至就是 Astra」。

然而,產學界目前對 AGI 仍未建立統一標準。即便 Astra 在 ARC-AGI-3 跑出 99.9%、FrontierMath Tier 4 達到 98% 的內部測試成績,也不等同於在所有情境具備完整人類判斷力與泛化水準。更務實的角度是:Astra 讓「人類與 AGI 的分界線」變得更為模糊。

能力越大,風險也隨之劇增。OpenAI 已證實 Astra 是首個達到其安全框架(Preparedness Framework)中「嚴重網路安全能力(Critical Cybersecurity Capability)」門檻的模型——在具備特定權限下,它已能自行發現未知漏洞並編寫攻擊方法。為此,官方同步啟動更嚴密的環境隔離與即時監控機制。

當 AI 承接工作的尺度從「回覆一句話」擴大為「接管整個數位作業系統」,技術的下半場競賽已悄然揭幕:比起爭論 AGI 是否降臨,企業與個人更該思考的是,我們準備好把多少控制權,真正交給眼前這位能幫忙點擊滑鼠與鍵盤的數位員工。