【AGI已到?】OpenAI推GPT-6 Astra 總裁稱身處AGI時代 網絡安全測試獲滿分 惟被指削弱監察透明度

最新財經消息

廣告

當一間公司的總裁公開表示「身處 AGI 時代並不為過」,這究竟是技術突破的誠實宣告,還是搶佔敘事高地的行銷語言?OpenAI 最新旗艦模型的發布,正把這個問題重新推上枱面。

OpenAI 於當地時間 9 月 3 日(周四)正式發布新一代模型 GPT-6 Astra,形容為公司對齊程度最高、能力最全面的模型。新模型率先於「Daybreak」企業測試計劃及少數認可用戶推出,其後數日內將陸續開放予 ChatGPT Plus、Pro、Business 及 Enterprise 用戶,並同步透過 OpenAI API 及 Amazon Web Services 提供。

【能力全面提升】操作電腦、寫程式、找漏洞

據介紹,GPT-6 Astra 在電腦操作、網頁瀏覽、軟件工程、網絡安全及科學研究等多個範疇均有明顯提升,其中「電腦使用」能力被形容為一大重點,模型可仿如真人般操作電腦介面、填寫表格及處理試算表。在網絡安全測試 ExploitBench(評估模型能否將已知漏洞轉化為可運作攻擊程式的基準)中,GPT-6 Astra 取得滿分 100%,相比之下,上一代模型的得分僅約 78.5%。另有報道指,模型在 ARC-AGI-3 基準測試中,配合工具運算下得分達 99.9%,惟在標準模式下得分僅 66%,反映不同測試條件下表現差距頗大。

【首見「嚴重」級網絡風險】被納最高規格監管

值得留意的是,GPT-6 Astra 是 OpenAI 首個在其「準備框架」(Preparedness Framework)下被界定為觸及「嚴重」(Critical)級網絡安全能力門檻的模型,意即模型具備在毋須人手介入下、針對經強化防護的真實系統識別並開發零日漏洞的能力。為此,公開版本將拒絕執行進階攻擊性任務,例如生成概念驗證漏洞程式;OpenAI 同時宣布名為「Daybreak for Frontline Defenders」的計劃,稱將投入 10 億美元資源,協助經審核的網絡防禦方運用相關前沿能力加強保安。

【AGI時代已到?】總裁言論惹業界審視

OpenAI 總裁 Brockman 在發布時表示,「身處 AGI 時代這個說法並不為過」,並形容通用人工智能的實現「並非一次性的大時刻,而是一點一滴累積而成」。這一表述屬公司自身框架與立場宣示,而非可獨立驗證的客觀事實。事實上,有分析已質疑新模型採用一種被稱為「不透明遞歸」(opaque recurrence)的推理技術,令外界難以像過往般透過「思維鏈監察」(chain-of-thought monitoring)追蹤及審核模型的決策過程;OpenAI 首席科學家亦承認,隨着模型能力提升,「可監察性正變得愈來愈具挑戰」,反映透明度或是能力提升過程中一項難以迴避的取捨。

項目 詳情 洞察
發布時間 當地時間9月3日(周四),率先開放企業與認可測試用戶 屬分階段限量推出,非即時全面開放
網絡安全測試 ExploitBench 得分100%,上代約78.5% 能力提升明顯,惟同時觸發最高風險監管級別
總裁AGI言論 稱「身處AGI時代並不為過」 屬公司立場表述,非獨立驗證的客觀事實
透明度質疑 新推理技術削弱思維鏈監察能力 業界對「愈強愈難監察」的取捨仍有保留

GPT-6 Astra 的能力提升幅度確實可觀,但「AGI 已經到來」始終是 OpenAI 自身的敘事角度,而非業界共識。網絡安全能力升級與監察透明度下降同步出現,這道能力與風險之間的平衡題,恐怕才是新模型真正值得持續追蹤的焦點。

免責聲明:本專頁刊載的所有投資分析技巧,只可作參考用途。市場瞬息萬變,讀者在作出投資決定前理應審慎,並主動掌握市場最新狀況。若不幸招致任何損失,概與本刊及相關作者無關。而本集團旗下網站或社交平台的網誌內容及觀點,僅屬筆者個人意見,與新傳媒立場無關。本集團旗下網站對因上述人士張貼之資訊內容所帶來之損失或損害概不負責。

撰文:經一編輯部