【Astra攻陷CAPTCHA】零失誤闖48關 奪人類認證 CAPTCHA驗證機制或加速被淘汰

最新財經消息

廣告

如果連分辨「你是不是人類」的最後一道防線都被人工智能攻破,網絡世界還有甚麼驗證機制可以信任?

有報道指,OpenAI 新一代模型 GPT-6 Astra 於 9 月 8 日(美西時間)被證實完成網絡遊戲《I’m Not a Robot》全部 48 個關卡,並取得遊戲設定的「人類認證證書」。OpenAI 團隊人員 Sharif Shamim 在社交平台上公開宣布這項結果,指 Astra「成功打通全部 48 關」。GPT-6 Astra 於 9 月 4 日起陸續向企業用戶及 Daybreak 平台開放,其後擴展至更多 ChatGPT 用戶,是 OpenAI 目前主力推廣的旗艦模型之一。

48 關人機驗證:由扭曲字母到餅乾扮狗

《I’m Not a Robot》是由知名網絡遊戲製作人 Neal Agarwal(其網站 Neal.fun 以趣味互動小遊戲聞名)設計的瀏覽器小遊戲,本意是以誇張、不斷變化的規則,戲仿現實中令人又愛又恨的 CAPTCHA 驗證關卡。遊戲共設 48 個關卡,題型包括辨認扭曲變形的字母組合、在視覺上極度相似的圖片中分辨「曲奇餅」與「狗」、在複雜街景圖片中準確圈出交通燈等特定物件,部分後段關卡規則更會突然改變,考驗使用者能否即時理解新指示並調整操作。過去,這類關卡一直被視為「機器容易失手、人類一眼看穿」的分水嶺,是最基本的網絡防機器人(bot)機制之一。

不止識圖:Astra靠操作真實瀏覽器過關

有報道指出,GPT-6 Astra 並非單純以圖像識別方式直接判斷答案,而是透過其「電腦操作」(Computer Use)能力,像真人一樣操作瀏覽器介面——包括讀取畫面內容、移動及點擊滑鼠、拖曳物件、輸入文字,並在每一關規則突然改變時重新理解指示、調整操作策略,全程未見失誤地完成 48 關。有分析認為,這反映該模型在圖像識別、時空推理(spatiotemporal reasoning)、指令理解及電腦操作整合能力上已逼近甚至超越一般人類水平,屬多模態能力的一次公開展示。值得留意的是,AI 模型評測機構亦曾為 GPT-6 Astra 打分:9 月 4 日發布時原按 4.1 版評測框架取得 61 分、暫列並列第五,其後按 4.3 版框架重新評分為 53 分,與另一模型並列第一,反映業界對新模型能力的評估標準仍在持續調整。

CAPTCHA形同虛設?業界憂驗證機制大限已到

Astra 全破 48 關並取得「人類認證」的結果,在科技業界引起廣泛討論。有觀察指出,傳統以圖像辨識為核心的人機驗證技術,一旦被具備電腦操作能力的 AI 模型輕易攻破,其防護作用將大幅削弱,甚至形同虛設。目前全球大量網站及應用程式仍依賴類似 CAPTCHA 的圖像驗證機制,防止機器人程式進行洗版留言、搶購、爬取數據或帳號盜用等行為;若此類驗證可被 AI 模型系統性破解,相關網站的防禦成本及風險將明顯上升。有報道引述業界人士表示,單靠靜態圖像辨識題目已不足以區分人類與 AI,預期未來驗證技術需要加快升級。

下一代防線:行為特徵分析登場

面對圖像式驗證機制可能失效,業界正加速研發及部署「行為特徵分析」(behavioral biometrics)等新一代防護方案。這類技術不再單靠使用者能否答對某道題目,而是透過分析滑鼠移動軌跡、點擊力度與節奏、打字速度與停頓模式、觸控手勢等細微行為特徵,判斷操作者是否人類,理論上較難被單純的圖像識別演算法模仿。與此同時,GPT-6 Astra 這次公開展示亦被放入更廣泛的行業背景討論:OpenAI 早前已表示,Astra 的能力已觸及所謂「關鍵網絡安全門檻」(critical cybersecurity threshold),意味模型具備獨立識別及執行針對高防護真實系統網絡攻擊的潛在能力。有報道指,OpenAI 因此在更廣泛推出 Astra 前,主動加設額外安全防護措施,並曾因安全考慮而放慢部分開發進度,包括暫停不符合強化防護要求的內部相關工作,以及與政府機構及第三方安全機構展開合作測試。

維度 具體情況 洞察
事件 GPT-6 Astra 完成《I’m Not a Robot》全部 48 關,取得「人類認證」 屬多模態識圖 + 電腦操作能力的公開示範,非單純答題
技術路徑 透過 Computer Use 操作真實瀏覽器:讀畫面、點擊、拖曳、輸入、適應規則變化 與純粹「餵圖辨識」不同,說明 AI 已可端到端完成複雜互動任務
模型背景 9 月 4 日起向 Daybreak 及企業用戶開放,其後擴展至更多 ChatGPT 用戶;曾被指觸及「關鍵網絡安全門檻」 能力提升同時伴隨額外安全防護與發布節奏放慢,反映業界對雙面風險的取態
行業影響 傳統 CAPTCHA 圖像驗證機制防護力被質疑,行為特徵分析等新方案加快推進 驗證技術「軍備競賽」料將持續,企業防禦成本或上升

這場看似「打機」式的示範,某程度上揭示了人工智能在圖像識別、推理與操作整合上的進展速度,已快於不少人的預期。CAPTCHA 會否真正走向淘汰、新一代驗證技術能否及時填補防線,仍需時間觀察與市場檢驗。

免責聲明:本專頁刊載的所有投資分析技巧,只可作參考用途。市場瞬息萬變,讀者在作出投資決定前理應審慎,並主動掌握市場最新狀況。若不幸招致任何損失,概與本刊及相關作者無關。而本集團旗下網站或社交平台的網誌內容及觀點,僅屬筆者個人意見,與新傳媒立場無關。本集團旗下網站對因上述人士張貼之資訊內容所帶來之損失或損害概不負責。

撰文:經一編輯部