Technologia deepfake znacznie ułatwiła osustom podszywanie się pod profesjonalistów biznesowych. Oszust może teraz dołączyć do rozmowy z włączoną kamerą i przekonująco odpowiadać na pytania w czasie rzeczywistym, wcielając się w inną osobę.

To trzeci kanał podszywania się z wykorzystaniem AI, po wiadomościach i głosie, i właśnie ten, na który firmy są najmniej przygotowane: twarz na rozmowie wideo wydaje się w pełni ludzka i niemożliwa do podrobienia.

Omówiliśmy już, dlaczego kampanie prób wyłudzenia informacji z wykorzystaniem AI są szybsze i łatwiejsze do przeprowadzenia, oraz jak klonowanie głosu zwiększa liczbę prób vishingu. W tym artykule przyjrzymy się, co się dzieje, gdy czyjaś tożsamość zostaje przejęta za pomocą deepfake’ów wideo, i jak zapobiegać wpadaniu członków zespołu w oszustwa deepfake.

Czym różni się oszustwo z użyciem deepfake wideo

Oszustwo za pomocą wiadomości opiera się na pisemnych szczegółach: właściwym tonie, właściwym kontekście i brzmiącej rozsądnie, ale pilnej prośbie. Klonowanie głosu opiera się na słuchu: znajomy głos mówi coś na tyle pilnego, by ominąć moment wątpliwości. Oszustwo z użyciem deepfake wideo idzie o krok dalej i stanowi zagrożenie dla jedynego instynktu weryfikacyjnego, którego większość ludzi nigdy nie kwestionuje: widoku twarzy i słyszenia czyjegoś głosu w czasie rzeczywistym podczas rozmowy, która wygląda dokładnie tak samo jak każde inne spotkanie wideo w kalendarzu.

Pracowników uczy się sceptycznie podchodzić do wiadomości i dokładnie sprawdzać niespodziewane rozmowy telefoniczne. Prawie nikogo nie uczy się kwestionowania rozmowy wideo twarzą w twarz, ponieważ wideo zawsze było równie godne zaufania jak spotkanie na żywo.

Ten nowy rodzaj oszustw wymaga ponownego przemyślenia tego, co jest zaufane w miejscu pracy, oraz tego, jak łatwo pośpiech może zignorować ustalone procesy.

Jak działają oszustwa deepfake w praktyce

Oszustwo z użyciem deepfake wideo może przybrać kilka różnych form. Najprostsza polega na odtworzeniu wcześniej nagranego deepfake’a wideo podczas rozmowy na żywo, czasem z wyłączoną przez atakującego własną kamerą i tłumaczeniem, że występuje problem z łącznością, by wyjaśnić, czemu „dyrektor” nie odpowiada naturalnie na dodatkowe pytania.

Bardziej wyrafinowane ataki wykorzystują narzędzia do zamiany twarzy w czasie rzeczywistym podczas rzeczywistej rozmowy na żywo, co pozwala atakującemu odpowiadać, kiwać głową i reagować na bieżąco — taki atak jest znacznie trudniejszy do wykrycia.

Wyłonił się też trzeci wzorzec, który opiera się konkretnie na spotkaniach onboardingowych i dotyczących zgodności. Syntetyczna persona w wideo podszywająca się pod audytora, nowego pracownika lub kontakt z działu HR może wysłuchać całego spotkania zaprojektowanego po to, by wydobyć dostęp do systemów, odpowiedzi na pytania zabezpieczające lub dane logowania — właśnie dlatego, że takie spotkania opierają się na założeniu, że rozmowa wideo z prawdziwą osobą jest z natury godna zaufania.

Prawdziwy przykład oszustwa deepfake

W 2024 roku pracownik działu finansów z hongkońskiego biura Arup(nowe okno), inżynieryjnej firmy z siedzibą w Wielkiej Brytanii, wziął udział w rozmowie wideo z osobami, które wyglądały jak dyrektor finansowy firmy i kilku jej współpracowników. Każda osoba na tej rozmowie była deepfake’em generowanym przez AI, stworzonym na podstawie publicznie dostępnych nagrań prawdziwych dyrektorów.

Wierząc, że prośba jest autentyczna, pracownik zatwierdził piętnaście przelewów na łączną kwotę około 25 mln USD, zanim wykryto oszustwo, a wykryto je dopiero dlatego, że akurat odzywał się do prawdziwej centrali firmy w sprawie „poufnej transakcji”, którą właśnie zrealizował.

Sprawa Arup pozostaje najjaśniejszym przykładem tego, jak wygląda taki atak na dużą skalę, ale nie był to wyjątkowy incydent. Z raportu o oszustwach UK Finance za 2026 rok(nowe okno) wynika, że łączne straty z tytułu oszustw płatniczych osiągnęły w 2025 roku 1,28 mld GBP, a raport szczególnie zwrócił uwagę na zorganizowane grupy przestępcze coraz częściej używające deepfake’ów, sklonowanych głosów i syntetycznych tożsamości do podszywania się pod zaufane osoby i obchodzenia kontroli tożsamości.

Odrębne badania branżowe firmy Sumsub(nowe okno) odnotowały 94% wzrost liczby prób deepfake w Wielkiej Brytanii rok do roku, a badanie Gartner przeprowadzone wśród liderów ds. bezpieczeństwa(nowe okno) wykazało, że 62% organizacji doświadczyło jakiejś formy ataku deepfake w ciągu poprzednich dwunastu miesięcy. Każda firma, która nadal traktuje to jako problem przyszłości, pozostaje w tyle za tym, co już pokazują dane.

Przypadek Arup jest szczególnie pouczający, jeśli chodzi o to, na co uważać. Pierwotny instynkt pracownika był słuszny: uznał oryginalną wiadomość za prawdopodobną próbę wyłudzenia informacji i poprosił o rozmowę wideo specjalnie po to, by to potwierdzić, co jest dokładnie tym krokiem weryfikacyjnym, jaki zalecałoby większość szkoleń z zakresu bezpieczeństwa.

Błąd nastąpił w kolejnym kroku, gdy sama rozmowa wideo została uznana za wystarczający dowód, ponieważ nikt nie powiedział mu, że przekonująca twarz na ekranie nie jest już wiarygodna. W tym momencie przyczyną porażki było niewystarczające szkolenie biznesowe, a nie pracownik.

Jakie są potencjalne scenariusze oszustw deepfake?

Opisane wyżej mechanizmy ujawniają się w kilku powtarzających się scenariuszach, z których każdy celuje w inny punkt dźwigni wewnątrz firmy. Wszystkie opierają się na tym samym podstawowym triku — przekonującej twarzy i głosie podczas rozmowy, która wygląda całkowicie normalnie — ale cel i korzyść mogą się różnić.

Twarz dyrektora finansowego zatwierdzająca przelew

Deepfake starszego dyrektora finansowego pojawia się podczas rozmowy i nakazuje podwładnemu zrealizować pilną, poufną płatność. Obecność znajomej, pozornie transmitowanej na żywo twarzy rozwiewa wątpliwości, jakie wywołałaby sama wiadomość.

Fałszywy audytor wyłudzający dane logowania do systemów

Syntetyczna persona udająca zewnętrznego audytora lub recenzenta zgodności przeprowadza wideorozmowę z pracownikami działów IT lub finansów, przedstawianą jako rutynowy przegląd, i zadaje pytania zaprojektowane specjalnie po to, by wydobyć szczegóły dostępu do systemów, odpowiedzi na pytania zabezpieczające lub dane logowania.

Syntetyczny menedżer HR przeprowadzający onboarding nowego pracownika

Deepfake’owy kontakt z HR przeprowadza rozmowę onboardingową z naprawdę nowym pracownikiem lub z obecnym pracownikiem pod pretekstem aktualizacji zasad i wykorzystuje sesję, by zdobyć szczegóły dotyczące systemów wewnętrznych, uprawnień dostępu lub danych potrzebnych do odzyskania danych logowania.

Podszywanie się pod członka zarządu wobec pracownika ds. finansów

Deepfake członka zarządu lub wyższego niezależnego dyrektora dołącza do rozmowy z pracownikiem ds. finansów, aby zatwierdzić transakcję lub poprosić o wrażliwe informacje finansowe, powołując się na autorytet stanowiska, którego zespół finansowy jest kulturowo uczony, by nie kwestionować.

Dlaczego oszustwa deepfake są trudniejsze do wykrycia

Większość programów szkoleniowych z zakresu ochrony przed próbami wyłudzenia informacji i vishingiem polega na nauczeniu ludzi dodawania tarcia do procesu, który ktoś próbuje przeforsować: wiadomość można przekazać dalej do działu IT w celu ponownego sprawdzenia, a rozmowę telefoniczną można zakończyć, aby zweryfikować numer telefonu.

Rozmowy wideo nie spotyka się z taką samą instynktowną czujnością, ponieważ przez lata rozmowa wideo była najbliższym cyfrowym zamiennikiem przebywania z kimś w jednym pomieszczeniu. Pracownikom rzadko mówi się, by podejrzliwie podchodzili do twarzy kolegi lub koleżanki, ponieważ kulturowe założenie stojące za wideokonferencjami to ich całkowita wiarygodność.

To właśnie to założenie wykorzystuje oszustwo z użyciem deepfake wideo. Atakujący nie musi przełamywać sceptycyzmu pracownika wobec samej prośby. Wystarczy, że dostarczy jedną rzecz, która w przeszłości zawsze kończyła sceptycyzm – znajomą twarz, która naturalnie odpowiada w czasie rzeczywistym.

To znacznie wyższa poprzeczka dla pracownika, dlatego protokoły weryfikacji dla tego kanału muszą mieć charakter proceduralny, a nie polegać na tym, że ktoś po prostu zauważy, iż coś jest nie tak.

Trzeba też podważyć pewną dynamikę społeczną. Kwestionowanie pisemnej prośby wydaje się zwykłą starannością. Kwestionowanie rozmowy telefonicznej wydaje się rozsądne, ponieważ podszywanie się pod czyjś głos od lat jest znanym ryzykiem.

Natomiast kwestionowanie twarzy podczas rozmowy wideo, zwłaszcza twarzy starszego kolegi lub koleżanki, może bardziej przypominać oskarżenie — i właśnie dlatego pracownicy wahają się to zrobić, nawet gdy coś w interakcji wydaje się nieco podejrzane. Usunięcie tego społecznego kosztu, sprawienie, by takie pytanie było rutynowe i oczekiwane, a nie niezręczne, jest równie ważną częścią zapobiegania deepfake’om i obrony przed nimi jak każde techniczne zabezpieczenie.

Protokoły weryfikacji skuteczne konkretnie w przypadku wideo

Utwórz kod

Z góry uzgodnione słowa kodowe lub gesty, ustalone wcześniej poprzez osobny kanał, to jedna z niewielu rzeczy, których deepfake naprawdę nie jest w stanie wygenerować, ponieważ nie istnieją one w żadnych publicznie dostępnych nagraniach, na których atakujący mógłby wytrenować model.

Prosta, zmienna fraza lub fizyczny sygnał, okresowo potwierdzany wśród kadry kierowniczej i zespołów finansowych, daje pracownikom coś konkretnego, o co mogą poprosić, zamiast polegać na subiektywnym odczuciu, że rozmowa wydaje się nieodpowiednia.

Ustanów niezmienne zasady autoryzacji

Żadna autoryzacja finansowa ani ujawnienie danych logowania nigdy nie powinny odbywać się wyłącznie podczas rozmowy wideo. To musi być konkretna zasada, a nie decyzja pozostawiona temu, kto akurat bierze udział w rozmowie: każda prośba tego rodzaju, niezależnie od tego, kto ma ją składać, wymaga drugiego potwierdzenia przez naprawdę osobny kanał, z użyciem szczegółów kontaktu już zapisanych w dokumentacji, a nie informacji podanych podczas samej rozmowy.

Pracownicy potrzebują wyraźnego, powtarzanego upoważnienia do zadawania pytania „Czy to naprawdę ty?” podczas każdej rozmowy, niezależnie od tego, kto pojawia się na ekranie. Powinni też czuć się swobodnie, prosząc przez inny kanał o dowód, że dana osoba jest tym, za kogo się podaje.

Instynkt, który powstrzymuje ludzi przed kwestionowaniem osoby na wysokim stanowisku, jest dokładnie tym, na czym opiera się ten atak, a instynkt ten znika tylko wtedy, gdy kierownictwo jednoznacznie komunikuje, że takie pytanie jest zawsze akceptowalne.

Prowadź dokumentację

Nagrywanie i rejestrowanie poufnych spotkań wideo, zwłaszcza wszystkiego, co dotyczy autoryzacji finansowych, dostępu do danych logowania lub onboardingu, daje firmie materiał do przejrzenia po fakcie, jeśli okaże się, że prośba była oszustwem, a świadomość, że spotkanie jest rejestrowane, jest sama w sobie pewnym środkiem odstraszającym dla atakujących, którzy wolą działać bez śladu.

Traktuj rozmowy wideo tak samo jak wiadomość

Oszustwo z użyciem deepfake wideo odnosi sukces, ponieważ wykorzystuje jedyny kanał, którego kwestionowania firmy nigdy nie uczyły pracowników. Oszustwa za pośrednictwem wiadomości są omawiane w ramach uświadamiania prób wyłudzenia informacji, a oszustwa głosowe — w ramach weryfikacji przez oddzwonienie oraz szkoleń, o których pisaliśmy w kontekście szeroko pojętej inżynierii społecznej.

Świadomość deepfake’owych rozmów wideo nie wymaga od pracowników stawania się analitykami kryminalnymi zdolnymi wykryć syntetyczne wideo klatka po klatce. Wymaga od firmy zaakceptowania, że przekonująca twarz i głos same w sobie już niczego nie dowodzą, oraz wypracowania nawyków weryfikacyjnych, które nie zależą od tego, czy ktokolwiek stanie się podejrzliwy w danym momencie.

Wzmacnianie tej kultury wraz z szerszymi praktykami omówionymi w naszym przewodniku dotyczącym budowania silnej kultury bezpieczeństwa w miejscu pracy daje zespołowi ten sam instynkt dotyczący wideo, który dobre szkolenia budują już w odniesieniu do wiadomości i rozmów telefonicznych.

Połączenie danych logowania: ograniczanie tego, na co może wpływać nieudana weryfikacja

Nieistotne, jaką formę przybiera atak z wykorzystaniem deepfake — fałszywy dyrektor finansowy, audytor czy zmyślony kontakt z działu kadr — ostatecznie zawsze chodzi o jedno z dwóch: transakcję finansową lub dane logowania. Wideo to jedynie kanał dostarczenia żądania, które — jeśli się powiedzie — albo bezpośrednio przekazuje pieniądze, albo daje atakującemu możliwość zalogowania się, pozwalającą wyrządzać szkody według własnego uznania.

Właśnie dlatego tak ważna jest higiena danych logowania, nawet jeśli sam atak na pierwszy rzut oka nie ma nic wspólnego z kradzionym hasłem. Jeśli rozmowa z deepfake skłoni kogoś do przekazania danych logowania, unikalne hasła i uwierzytelnianie wieloskładnikowe ograniczają to, na co faktycznie może wpływać jeden taki zestaw danych.

Zasada ograniczania szkód, o której pisaliśmy w kontekście oszustw typu business email compromise, ma tu również zastosowanie: nie chodzi o to, by każdy pracownik był samodzielnie niepokonany w starciu z wyrafinowanym atakiem, lecz o to, by po nieudanej weryfikacji szkody pozostały ograniczone.

Firmowy menadżer haseł, taki jak Proton Pass for Business, sprawia, że ograniczanie szkód staje się realne do utrzymania: usuwa presję na ponowne używanie znanych haseł w wielu kontach i ułatwia pracownikom przestrzeganie zasad dotyczących haseł. W połączeniu z bezpieczną platformą do wideokonferencji oraz kulturą pracy, w której wstrzymanie się w celu weryfikacji jest traktowane jako coś normalnego, a nie podejrzanego, to właśnie taki zestaw faktycznie ogranicza szkody, gdy wideorozmowy przestają być w pełni zaufane.

Ogranicz narażenie swojego zespołu na oszustwa polegające na podszywaniu się dzięki firmowemu menadżerowi haseł.