Meta 的 Muse AI 助理內部指令外洩:研究人員深入解析
Meta 最近推出的個人助理 Muse,在短時間內吸引了數百萬下載者。使用者可將銀行帳戶、訊息或健康資料與 Muse 連結,讓 AI 代理人代為完成各種任務。隨著下載量激增,研究人員從應用程式內部取得了大量指令檔案,首次窺見 Muse 的運作原理與資訊呈現方式。Meta 表示,這些檔案原本就應該公開,以提升透明度,且其中也揭露了 AI 在回應高度政治或敏感議題時的行為模式。
研究者如何取得內部指令
獨立的 AI 安全與資安研究員 Karan Joshi 透過 Muse 的一般聊天介面,請求助理「複製並分享自己的軟體檔案」,成功抽取了大量系統提示(system prompts)與操作說明,隨後將結果提供給《WIRED》報導。Joshi 的方法顯示,Muse 並未對此類請求設置足夠的防護,導致內部指令可被直接讀取。
內部指令的核心功能:為每位關係人物建立「頁面」
其中一項指令明確規定,Muse 必須 為使用者生活中的每一位人物建立一頁。這些人物包括家人、伴侶、朋友、同事、合作夥伴以及使用者「追蹤」的對象。系統會每小時匯整相關資料,形成結構化文字檔(即「記憶」),內容可能涵蓋:
- 事實(Facts):居住地、職業等基本資訊
- 歷史(History):過往互動、共同經歷的事件
- 關係(The relationship):與使用者的關係類型與親密度
- 共同點(In common):雙方的興趣或共同目標
- 未解決的議題(Open threads):尚未完成的計畫或討論
- 強化建議(Strengthening):改善關係的具體建議
指令強調,Muse 只能使用「可驗證的證據」填寫頁面,若無足夠資料,寧可留下空白,而非自行捏造細節。系統還會記錄「重要日期」── 如生日、紀念日── 以便在適當時機提醒使用者。
可能的隱私衝擊與 Meta 的歷史背景
Joshi 在分析後指出,Muse 的設計顯示 Meta 想要像朋友般深入了解使用者的社交關係,這在隱私層面相當令人不安。Meta 早前因社交平台的資料濫用爭議屢屢成為焦點,此次助理直接利用其龐大的社群資料庫,為每位關係人物自動生成資訊頁面,無疑加深了對個人私密資訊的挖掘。
雖然 AI 聊天機器人(如 ChatGPT)長期被用來提供感情建議,但 Muse 的「全方位關係圖譜」是首次將社交圖譜與個人助理深度結合,讓使用者在不知情的情況下,可能被 AI 觀測與分析其日常人際互動。
未來展望與使用者的自我防護
此事件提醒業界與大眾,AI 產品的內部指令與資料流程必須接受獨立審核,以防止過度收集與濫用。未來若 Meta 繼續擴大 Muse 的功能,可能需要:
-
更嚴格的權限管理:限制 AI 直接讀取或匯出自身程式碼的能力。
-
透明的資料來源說明:明示每筆資訊的取得渠道與可信度。
-
使用者可控的關係資料:允許使用者自行決定哪些人物可以被建立頁面,或完全關閉此功能。
對於已安裝 Muse 的使用者,建議檢視應用程式的隱私設定,審慎授權銀行、健康或訊息資料的存取,同時關注未來 Meta 是否推出更明確的資料刪除與撤回機制。
結語:Muse 的內部指令外洩不僅揭露了 AI 助理背後的運算邏輯,也敲響了隱私保護的警鐘。唯有在透明、可審查與使用者主導的前提下,AI 才能真正成為可信賴的生活夥伴。