預計閱讀 1 分鐘原文來源
核心重點
OpenAI 依賴數百名合約員工審閱真實的 ChatGPT 使用者對話,以提升模型回應品質。這些審閱工作在 404 Media 揭露的內部文件中被證實,且部分使用者的對話即使已匿名化,仍可能包含敏感個人資訊,引發隱私爭議。
背景與運作機制
- 合約員工來源:透過 Crossing Hurdles(連結 AI 工作的招聘平台)招募,薪資由 AI 訓練公司 Mercor 發放,北美一名審閱者的時薪超過 50 美元。
- 審閱流程:員工依 1 至 7 分的等級評分 ChatGPT 的回應,重點是削減過度恭維與過於擬人化的表現。
- 隱私處理:對話在送交審閱前會被匿名化,仍可能保留使用者自行輸入的個人資料。OpenAI 使用隱私過濾器(privacy filter),但承認該機制並非萬無一失。
使用者若在設定中關閉「改善模型給所有人」選項,則其新對話不會被用於模型訓練,也不會被人工審閱;此外,OpenAI 另提供「暫時聊天模式」,聲稱不會將輸入資料用於模型訓練。
隱私爭議與影響
- 資訊透明度不足:OpenAI 在官方 FAQ 中僅以「授權人員與服務供應商可能會檢視使用者資料」的模糊說明,且此說明自 2023 年起僅有微幅調整,未明確告知使用者有多少對話會被人工審閱。
- 使用者同意的形式問題:預設開啟的「改善模型」設定看似是社群貢獻的友善呼籲,實則相當於默示同意讓人類閱讀對話。若改為明確徵求同意,預估會有大量使用者選擇退出。
- 產業普遍做法:Anthropic 亦承認會讓人類審閱 Claude 的回應,且在隱私設定開啟「協助改進模型」時才會進行;Google Gemini 亦在說明文件中提及可能有人類審閱已儲存的對話。這顯示人工回饋是大型語言模型(LLM)優化的關鍵環節,且已成為業界慣例。
未來展望與建議
-
提升資訊揭露:平台應在使用者介面上以醒目方式說明「人類審閱」的範圍與目的,避免僅以 FAQ 隱蔽呈現。
-
加強匿名化技術:在送交審閱前,必須確保所有可辨識資訊(如姓名、電話、地址)徹底剔除,以降低資料外洩風險。
-
提供更細緻的選項:除了「改善模型」的二元開關,建議增設「僅機器學習」與「完全不參與」等多層選項,讓使用者自行決定資料的使用方式。
-
監管與標準制定:隨著 AI 服務日益普及,政府與業界應共同制定關於人工審閱的透明度與隱私保護標準,確保使用者權益不被忽視。
在 AI 技術持續突破的同時,如何在提升模型效能與保障使用者隱私之間取得平衡,將成為未來數位生態的重要課題。讀者在使用 ChatGPT 前,務必檢視隱私設定,了解自己的對話可能被誰、以何種方式使用。
分享
