【美高盛分析師遭AI舉報】25歲華裔向ChatGPT自爆想姦殺前女友被捕 拆解OpenAI何時會報警 你對話原來未必私密
據報道,涉事者為現年 25 歲、任職美高盛(Goldman Sachs)的華裔財經分析師 Darren Zhou(周達倫),事發於美國佛羅里達州。他與 21 歲前女友在拍拖約半年後分手,其後在與 ChatGPT 的對話中,多次流露對前女友的暴力威脅,內容涉及跟蹤及傷害的情節。OpenAI 的系統偵測到相關對話後,經人手審查,認為屬對他人的迫切威脅,遂向執法部門舉報並提交對話紀錄。他其後於 5 月被捕,以 10 萬美元保釋,6 月遭美高盛解僱;至 8 月,他就跟蹤及威脅等控罪認罪,據報被判緩刑及一系列限制條件,包括電子監察、禁止接觸受害人、禁止持有槍械及接受相關輔導。以下嘗試從機制層面拆解 AI 平台的監控與私隱標準,僅屬一般資訊。
【事件回顧】一句威脅 由對話變報案
據報道,這宗個案的關鍵,不在於當事人做了甚麼實際行動,而在於他把傷害他人的念頭「打」進了 ChatGPT。他在對話中表達了在特定時間、以特定方式傷害前女友的意圖,內容具體而露骨。正是這些輸入,觸發了 OpenAI 的安全機制:系統先行識別出對話含潛在威脅,再交由專責團隊人手審查,最終判斷屬對他人的迫切人身威脅,並轉介執法部門。由被捕、解僱到認罪,整條時間線把一個一般人容易忽略的事實擺上枱面——與 AI 的私密對話,並非全然無人知曉。
【機制一】AI 幾時會「報警」?三步走拆解
一般而言,根據 OpenAI 公開的安全說明,其處理用戶內容大致分三步。第一步是偵測:平台以自動化系統(如分類器、比對機制等)大規模監測對話,識別可能違反使用政策的內容。第二步是人手審查:當偵測到用戶似在計劃傷害他人,相關對話會被送往由受過使用政策訓練的專責小組審視,該小組有權採取行動,包括封禁帳戶。第三步是轉介執法:若人手審查判斷個案涉及「對他人造成嚴重人身傷害的迫切威脅」,平台可將個案轉介執法部門。
值得留意的是當中一條界線:據 OpenAI 說明,涉及自我傷害的個案,基於對話的私密性質,目前一般不會轉介執法;但涉及傷害「他人」的迫切威脅,則屬會採取行動的範疇。換言之,AI 並非對所有敏感內容都會報警,但一旦涉及對他人的具體、迫切威脅,機制就可能啟動。
| 步驟 | 做法 |
|---|---|
| 偵測 | 自動化系統大規模監測,識別潛在違規/威脅內容 |
| 人手審查 | 疑似計劃傷害他人的對話交專責小組審視,可封禁帳戶 |
| 轉介執法 | 判斷屬對他人迫切嚴重傷害威脅,可轉介執法部門 |
| 界線 | 自傷個案一般不轉介執法;傷害他人的迫切威脅則會採取行動 |
【機制二】你同 AI 講話 有多私密?
不少人把 ChatGPT 當成「樹洞」,其實對話並非絕對私密。一般而言,根據 OpenAI 的私隱政策,用戶輸入的內容可被自動系統、以及在部分情況下的人手審查所檢視,用於安全與濫用偵測及改進服務;即使關閉聊天紀錄,基於濫用審查的需要,內容一般仍會保留一段短時間(約 30 日),若涉及法律或濫用調查更可延長。
對香港用戶而言,同樣值得留意:把個人敏感資料,甚至可能牽涉違法的內容輸入海外 AI 平台,既有私隱風險,亦可能在特定情況下成為呈堂或轉介的材料。實用的原則其實很簡單:不要把不想被任何人看到的內容交給 AI,尤其是任何涉及傷害自己或他人的念頭——真正需要幫助時,應尋求專業或緊急支援,而非向聊天機械人「宣洩」。這宗個案給普通用戶的最大提醒,或許就是:AI 對話方便,但它不是保險箱,更不是樹洞。
本文僅屬一般資訊,並不構成法律意見。
免責聲明:本專頁刊載的所有投資分析技巧,只可作參考用途。市場瞬息萬變,讀者在作出投資決定前理應審慎,並主動掌握市場最新狀況。若不幸招致任何損失,概與本刊及相關作者無關。而本集團旗下網站或社交平台的網誌內容及觀點,僅屬筆者個人意見,與新傳媒立場無關。本集團旗下網站對因上述人士張貼之資訊內容所帶來之損失或損害概不負責。
—

