Deepfake 技術讓詐騙份子冒充商業人士變得容易許多。如今詐騙者可以開啟鏡頭加入通話,即時以另一人的身分令人信服地回答問題。

這是繼電子郵件和語音之後,運用 AI 冒充他人的第三種頻道,也是企業最缺乏防備的一種:視訊通話中出現的臉孔給人完全真實的感受,讓人認為絕不可能造假。

我們已介紹過AI 網路釣魚攻擊的發動速度更快、難度更低,以及語音複製如何使語音釣魚攻擊增加。本文將探討當他人的身分遭到 Deepfake 影片冒用時會發生什麼,以及如何防止團隊成員落入 Deepfake 詐騙的圈套。

Deepfake 視訊詐騙有何不同

電子郵件詐騙依靠書面細節:恰當的語氣、貼合情境的內容,以及聽起來合理卻要求緊急處理的請求。語音複製依靠聽覺:熟悉的聲音說著緊急到讓人來不及起疑的內容。Deepfake 視訊詐騙則更進一步,突破了大多數人從未想過要質疑的驗證本能:在視訊通話中即時看到某人的臉孔並聽見其說話,而這場通話看起來與行事曆上的其他視訊會議毫無二致。

員工接受的訓練是對電子郵件保持警惕,並對接到的不明來電再三查證。然而,幾乎沒有人被教導要質疑面對面的視訊通話,因為視訊向來與實體會議一樣值得信任。

這種詐騙的新形式要求我們重新審視工作中哪些事物可以信任,以及緊急情況能多輕易地讓人跳過既定流程。

Deepfake 詐騙在實務上的運作方式

Deepfake 視訊詐騙可能有幾種不同形式。最簡單的是在直播通話中播放預先錄製的 Deepfake 影片,攻擊者有時會將自己的鏡頭靜音,並聲稱是連線問題,藉此解釋為何這位「高層」對後續追問的反應不夠自然。

更精密的攻擊會在實際的直播通話中使用即時換臉工具,讓攻擊者得以當場回應、點頭並做出反應,這種手法遠比前者更難察覺。

第三種模式也已經出現,專門針對入職和合規會議。合成的影片人物可偽裝成稽核員、新進員工或人資聯絡人,全程參與一場旨在套取系統存取權限、安全問題答案或憑證的會議,正是因為這類會議建立在「與真人視訊通話本質上值得信任」的假設之上。

真實世界的 Deepfake 詐騙案例

2024 年,總部位於英國的工程公司 Arup 香港辦公室的一名財務員工,與幾位看似是公司財務長 (CFO) 及多名同事的人士進行視訊通話。通話中的每一個人都是 AI 生成的 Deepfake,根據真實高層的公開影片片段合成。

由於相信請求是真的,該員工在詐騙被識破之前核准了 15 筆轉帳,總額約 2,500 萬美元;而之所以被識破,只是因為他事後碰巧向公司真正的總部追問這筆剛完成的「機密交易」。

Arup 案至今仍是這類大規模攻擊最清楚的實例,但它並非孤立事件。UK Finance 的《2026 年詐騙報告》指出,2025 年整體支付詐騙損失達 12.8 億英鎊,並特別點出有組織的犯罪集團越來越多地利用 Deepfake、複製語音和合成身分來冒充值得信任的人士,藉此規避身分驗證。

另外,Sumsub(新視窗) 的產業研究記錄到英國的 Deepfake 攻擊嘗試年增 94%,而一項針對資安主管的Gartner 調查(新視窗)發現,62% 的組織在過去十二個月內曾遭遇某種形式的 Deepfake 攻擊。任何仍將此視為未來問題的企業,都已經落後於數據所反映的現實。

Arup 事件尤其能讓我們了解該注意哪些地方。該員工最初的直覺是正確的:他將原本的電子郵件視為可能是網路釣魚嘗試,並特意要求視訊通話加以確認,這正是大多數資安訓練建議的驗證步驟。

問題出在下一個步驟:視訊通話本身被視為足夠的證明,因為沒有人告訴他,螢幕上一張逼真的臉孔已不再可靠。在那個當下,錯誤源自業務訓練不足,而非該名員工本身。

有哪些潛在的 Deepfake 詐騙情境?

上述手法會以幾種反覆出現的情境呈現,各自針對企業內部不同的薄弱環節。它們共享同一套底層伎倆:通話中出現足以亂真的臉孔和聲音,整體看來完全正常,但目標與目的可能各有不同。

由財務長的臉孔核准電匯轉帳

某位資深財務主管的 Deepfake 出現在通話中,指示下屬處理一筆緊急的機密付款。熟悉且看似即時連線的臉孔,消除了光是收到電子郵件就會引發的疑慮。

由假稽核員套取系統憑證

合成的人物偽裝成外部稽核員或合規審查人員,以例行審查為名,對 IT 或財務人員進行視訊訪談,並提出專門設計的問題,以套出系統存取詳細資料、安全問題答案或登入資訊。

由合成人資經理為新進員工辦理入職

Deepfake 人資聯絡人與真正的新進員工進行入職通話,或以政策更新為由聯繫現有員工,並利用該工作階段蒐集內部系統、存取權限或憑證復原資訊等詳細資料。

冒充董事會成員聯繫財務主管

某位董事會成員或資深非執行董事的 Deepfake 加入與財務主管的通話,以核准交易或索取敏感財務資訊,倚仗的是財務團隊在文化上被訓練不得質疑的職位權威。

為什麼 Deepfake 詐騙更難察覺

大多數防範網路釣魚和語音釣魚的訓練課程,都是教人們在他人試圖倉促通過的流程中增加摩擦:電子郵件可以轉寄給 IT 部門再三確認,電話也可以先掛斷,再核對電話號碼。

視訊通話不會受到同樣本能的審視,因為多年來,視訊通話一直是與他人同處一室最接近的數位替代方式。員工很少被告知要懷疑同事的臉孔,因為視訊會議背後的文化假設就是它完全可靠。

這個假設正是 Deepfake 視訊詐騙所利用的弱點。攻擊者不需要化解員工對請求本身的懷疑,只需提供過去總能消除懷疑的那一樣東西:在通話中即時自然回應的熟悉臉孔。

對員工而言,這是高得多的門檻,因此這個頻道的驗證機制必須訂為明確流程,而不能只依賴有人剛好察覺情況不對。

還有一種社會心理必須打破。質疑書面請求感覺像是再平常不過的謹慎;質疑電話也顯得合理,因為冒用他人聲音多年來已是眾所周知的風險。

但質疑視訊通話中的臉孔,尤其是資深同事的臉孔,可能更像是指控對方,這正是員工即使隱約覺得互動有異也遲遲不敢開口的原因。消除這種社會成本,讓提問成為例行且被期待的舉動而非尷尬之舉,與任何技術控管一樣,都是防範 Deepfake 與整體防禦的一環。

專門適用於視訊的驗證機制

建立代碼

事先透過另一個頻道約定好的暗號或手勢,是 Deepfake 真正無法產出的少數東西之一,因為攻擊者可用來訓練模型的任何公開影片中都不存在這些暗號。

一句簡單、可更換的暗語或一個肢體訊號,由高層人員和財務團隊定期確認,能讓員工有具體的東西可以要求,而不必依賴「通話感覺不對勁」這種主觀感受。

把授權規則定為鐵律

任何財務授權或憑證揭露都絕不應僅透過視訊通話進行。這必須是明確的政策,而非交由通話當下的在場者自行判斷:任何此類請求,無論看似由誰提出,都必須透過真正獨立的頻道進行第二次確認,並使用檔案中已有的聯絡詳細資訊,而不是通話中提供的任何資訊。

員工需要獲得明確且反覆重申的許可,才能在任何通話中詢問「這真的是你嗎?」,無論螢幕上看似是誰。他們也應該能自在地透過另一個頻道要求對方證明自己的身分確實如其所稱。

阻止人們質疑高層人物的直覺,正是這種攻擊所仰賴的東西;只有當領導層明確表示這個問題永遠可以提出時,這種直覺才會消失。

保留紀錄

錄影並記錄敏感的視訊會議,特別是涉及財務授權、憑證存取或入職的會議,能讓企業在事後發現請求有詐時有據可查;而知道會議已有記錄,本身也對偏好不留痕跡行事的攻擊者構成一定程度的嚇阻。

像對待電子郵件一樣對待視訊通話

Deepfake 視訊詐騙之所以得逞,是因為它利用了企業從未訓練員工去質疑的那個頻道。電子郵件詐騙已有網路釣魚意識教育涵蓋,語音詐騙則有回撥驗證,以及我們在更廣泛的社交工程方面撰寫的訓練內容。

了解 Deepfake 視訊通話並不要求員工成為能逐格分析合成影片的鑑識分析師,而是要求企業接受一點:逼真的臉孔和聲音本身已不再能證明任何事情,並建立不依賴任何人在當下起疑的驗證習慣。

將這種文化與我們建立強固職場安全文化指南中涵蓋的更廣泛做法並行推動,能讓團隊對視訊培養出與良好訓練早已為電子郵件和電話建立的相同直覺。

憑證連線:限制驗證失敗時可能波及的範圍

無論深偽影片攻擊以何種形式出現——財務長詐騙、假冒稽核員,還是虛構的人資聯絡人——最終目標都不外乎兩者之一:一筆金融交易,或一組憑證。影片本身只是傳遞要求的載體,這項要求一旦得逞,不是直接調動資金,就是讓攻擊者取得登入權限,從而隨心所欲地造成損害。

這正是憑證衛生如此重要的原因,即使攻擊起初與遭竊的密碼毫無關聯。如果一段深偽通話騙取了某人的憑證,獨一無二的密碼與多因素驗證就能限制該憑證實際能觸及的範圍。

我們在談論商務電子郵件入侵時說明過的同一種圍堵原則,在此同樣套用:目標不是讓每位員工都能單獨抵禦精密攻擊而不敗,而是確保驗證一旦失敗,損害能被控制在一定範圍內。

像 Proton Pass for Business 這樣的企業密碼管理程式,讓圍堵措施得以長期落實:它移除了在各帳號間重複使用熟悉密碼的壓力,也讓員工更容易遵守你們的密碼政策。再搭配一個安全的視訊會議平台,以及一種將「暫停下來驗證」視為正常而非可疑的職場文化,當視訊通話本身不再能被完全信任時,這樣的組合才能真正限制損害。

透過企業密碼管理程式,降低你們的團隊遭遇冒充詐騙的風險。