NASK prezentuje autorskie narzędzie DROZD, które ułatwi identyfikację deepfake’ów

Naukowa i Akademicka Sieć Komputerowa zaprezentowała autorskie rozwiązanie o nazwie DROZD, stworzone do analizy oraz wykrywania fałszywych materiałów typu deepfake. Narzędzie umożliwia szczegółowe badanie nagrań wideo, ścieżek dźwiękowych oraz zdjęć zmanipulowanych przy użyciu sztucznej inteligencji. System znajduje się obecnie w fazie pierwszych pilotaży operacyjnych.

 

Jak działa technologia do analizy fałszywych nagrań?

Rozwiązanie DROZD bazuje na strukturze modułowej, co pozwala na dostosowanie poszczególnych elementów do potrzeb konkretnych odbiorców. Narzędzie potrafi badać materiały w zróżnicowanych warunkach, w tym mocno zaszumione pliki publikowane w mediach społecznościowych. Istotnym punktem prac było stworzenie algorytmów radzących sobie z manipulacjami typu lip-sync, gdzie cyfrowo dopasowuje się ruch ust do nowej ścieżki dźwiękowej na autentycznym wideo. Przedstawiciele NASK zwracają uwagę, że tradycyjne oprogramowanie detekcyjne często nie radziło sobie z tego typu modyfikacjami.

 

Do stworzenia przekonującego materiału syntetycznego wystarczy dziś często kilkanaście sekund czyjejś mowy, a czasem nawet kilka sekund. Może to być jedno zdjęcie albo krótki, publicznie dostępny fragment nagrania. Współczesne narzędzia pozwalają tworzyć materiały zachowujące spójność postaci i oferują dostęp do wielu zaawansowanych modeli generatywnych w jednym miejscu – zaznaczyła dr inż. Ewelina Bartuzi-Trokielewicz, kierownik Zakładu Analiz Audiowizualnych i Systemów Biometrycznych w NASK.

 

Pięć poziomów weryfikacji publikowanych treści

Weryfikacja zgłoszonego materiału przebiega na pięciu osobnych płaszczyznach obejmujących opis i klasyfikację, jakość językową, techniki perswazji, podmioty oraz weryfikację faktów. W obszarze wizualnym algorytmy analizują cechy statyczne i dynamiczne twarzy, a także sprawdzają obecność klatek ze zbiorów gotowych materiałów multimedialnych. W ścieżce dźwiękowej system automatycznie przekształca wypowiedzi na tekst oraz ocenia naturalność brzmienia. Dodatkowo oprogramowanie gromadzi wzorce wizerunków osób publicznych, które są najbardziej narażone na wykorzystanie w oszukańczych schematach. Zgromadzone dane pozwalają skrócić czas potrzebny na identyfikację podszywania się pod znane postacie.

 

Skala problemu i sposoby działania oszustów

Prace nad narzędziem są odpowiedzią na rosnącą liczbę oszukańczych reklam w sieci. Pięciotygodniowy monitoring mediów społecznościowych przeprowadzony przez analityków NASK wykrył 16 tysięcy materiałów zawierających treści syntetyczne. W takich kampaniach przestępcy użyli wizerunków ponad 450 różnych osób publicznych. Oszuści stosują zaawansowane techniki, takie jak maskowanie treści przed systemami moderacji oraz szybka rotacja plików. W jednej z analizowanych kampanii zarejestrowano aż 930 osobnych plików reklamowych. Co więcej, grupy przestępcze tworzące deepfake’i funkcjonują w sposób zorganizowany, przypominający strukturę dużych przedsiębiorstw.