![]()
隨著 AI 模型變得更強大,這些模型被誤用的潛在風險也隨之增加——呼籲建立安全護欄以防止此類濫用的聲浪也日益高漲。AI 公司現在必須在尊重企業客戶隱私與監控使用情況以防可能問題之間,維持微妙的平衡。
察覺到有機會超越競爭對手 Anthropic,OpenAI 剛剛宣布了一項以隱私為中心的監控誤用安全方法。該公司正在向特定客戶預覽一項名為 Private Safety Processing 的新服務。這是一套自動化系統,能在監控潛在濫用的同時,完全不保留客戶的任何資料。
這套系統明顯與 Anthropic 最近宣布的資料保留政策背道而馳。該政策已引起部分客戶不滿,它允許這家 AI 實驗室在「涵蓋模型」的情況下,保留使用者資料(所有對話紀錄及其中的對話內容)長達 30 天。該公司表示,這些模型包括所有 Mythos 類別模型以及「具有類似能力的未來模型」。
這項在七月宣布的政策,目的是為了安全考量,讓實驗室得以篩選和分析潛在的不當行為。然而,它已深深引起某些處理大量敏感資料企業的擔憂,這些企業不希望資料被 AI 實驗室保存(或檢查)。
OpenAI——如同大多數其他 AI 公司——已透過遵守名為 Zero Data Retention 的政策,為客戶提供相對程度的隱私。ZDR 利用 OpenAI API 內的代理程式,以每個工作階段為單位監控濫用行為。透過這種方式,公司不會保留客戶資料,但仍能掃描不良活動而無需人工介入。值得注意的是,Anthropic 也大致遵守 ZDR——但「涵蓋模型」如 Fable 則屬例外。
OpenAI 表示,Private Safety Processing 是一項新技術,能擴大 ZDR 的適用範圍。它將其描述為一種長期安全監控形式,能評估多個對話的輸入與輸出——而非僅限單一對話。同樣地,監控由代理程式執行,若被觸發,便會捕捉互動並跨工作階段分析潛在誤用的跡象。
該新技術有助於 OpenAI 偵測跨越多個工作階段的惡意 AI 使用,一位發言人告訴 TechCrunch。惡意行為者——假設是試圖為網路攻擊開發惡意軟體的人——可能會分散他們的請求以避免被偵測。Private Safety Processing 能在無需人工審查使用者對話的情況下,分析這些多個對話以找出濫用跡象。
在系統被觸發的情況下,它可能會向 OpenAI 發送一個「明確定義的訊號」,警告特定類型的活動,公司表示。根據該訊號,OpenAI 便能決定是否「需要執行執法措施」,它說。若是如此,OpenAI 將聯繫客戶以取得更多脈絡,或與他們合作解決問題,而客戶可自行決定是否與 OpenAI 分享資料,發言人表示。
相較之下,Anthropic 表示對客戶資料的人工審查可能會發生,但僅限「透過受控存取路徑」,且涉及「一小群經過批准的審查者」。公司表示,每一次審查工作階段都會「記錄在防篡改的日誌中,審查者無法抑制或修改」。
OpenAI 與 Anthropic 之間的企業競爭目前相當緊張,雙方都在尋找任何能取得優勢的機會。一份近期報告顯示,OpenAI 第二季的成長速度慢於 Anthropic。Anthropic 的年化收入運行率據報現已達到 650 億美元。Anthropic 的投資者表示,它可能以 2 兆美元的估值 IPO,而 OpenAI 也正在準備其 IPO。
當您透過我們文章中的連結購買時,我們可能會賺取少量佣金。這不會影響我們的編輯獨立性。
Lucas 是 TechCrunch 的資深作家,負責報導人工智慧、消費性科技和新創公司。他之前曾在 Gizmodo 報導 AI 和網路安全。
您可以透過 [email protected] 聯繫 Lucas。