[XF 新聞] WhatsApp 推「Scam Alert」防騙新功能! 裝置端 AI 自動識別詐騙訊息

- 辛尼 - 2026-08-17 - visibility Views

WhatsApp 正測試一項名為「Scam Alert」的全新防騙功能,利用裝置端機器學習模型自動識別潛在詐騙訊息,並在對話中向用戶發出警告,整個分析過程完全在手機內完成,訊息內容不會離開裝置,亦不會自動上傳至 Meta 或 WhatsApp 伺服器。此功能旨在配合端到端加密架構,在不犧牲私隱的前提下,為用戶提供多一層防騙保障。

用戶開啟 Scam Alert 後,系統會下載一個專為識別詐騙模式而訓練的小型分類模型至手機,該模型根據過往用戶舉報的詐騙對話學習語言結構及對話模式,從而判斷非聯絡人發來的訊息是否屬於已知詐騙手法。一旦模型判定訊息可疑,會在對話框內顯示僅用戶可見的警示,對方完全無法察覺。用戶可選擇封鎖、舉報或繼續對話。若認為警示錯誤,亦可將對話標記為「信任」,系統之後不會再對該聯絡人發出警示,並可選擇性地分享最近 5 則訊息給 WhatsApp,協助改善模型準確度。

為確保私隱與透明度,Meta 設計多項技術保障。首先,所有模型版本連同 SHA-256 雜湊值均會先公開記錄在第三方不可篡改的透明分類帳(transparency ledger),之後才透過 CDN 分發,下載請求經 OHTTP 中繼伺服器處理並剔除用戶 IP 地址,配合匿名憑證驗證,令伺服器無法得知是哪部裝置提出請求,亦無法向特定用戶派發特製模型。其次,用戶可在應用內查閱「Scam Alert 活動」日誌,了解哪些訊息被掃描、結果如何及使用了哪個模型版本。

至於功能成效評估,WhatsApp 僅收集匿名聚合數據,例如警示觸發次數及用戶反應(封鎖、舉報或信任),相關統計經由建基於可信執行環境(TEE)的保密聯合分析管道處理,結果套用差分私隱技術加入雜訊,再以達到最低群組人數門檻的匿名統計形式交回 WhatsApp,確保任何單一用戶的資料都不會被還原。Meta 同時擴大 Bug Bounty 計劃,邀請安全研究員檢視模型行為及分析管道,並承諾公開模型權重供獨立驗證,確認其僅用於識別詐騙而非其他用途。

Scam Alert 目前正以有限度形式在 Beta 版本推行測試,官方尚未公布正式推出時間、支援平台及語言(包括廣東話與繁體中文)的準確度。對於長期受 WhatsApp 詐騙困擾的香港用戶而言,此功能若能量產並保持高準確度,將成為繼雙步驟驗證、未知來電靜音及群組安全概覽後的又一重要防線。

資料來源