Jak się nie dać nabrać na wideo wygenerowane przez AI
Podcast Aleksandry Sobczak to rozmowy z dziennikarzami i dziennikarkami o ich tekstach i o najważniejszych sprawach, które dotyczą mediów - polskich i światowych, tradycyjnych i tych opartych na łasce i niełasce algorytmów. Gościem tego odcinka jest Krystian Buczek, który na co dzień wydaje na profilach społecznościowych "Wyborczej". Ale pretekstem do rozmowy jest jego tekst z Magazynu "Wyborczej" o tym, jak AI zmieniło reguły gry i nasze korzystanie z portali społecznościowych, a także o tym, że filmy - te generowane przez sztuczną inteligencję - stają się coraz trudniejsze do rozpoznania i rozróżnienia. Tekst Krystiana możecie przeczytać tutaj: https://wyborcza.pl/magazyn/7,124059,32373463,nie-dajcie-sie-na-to-nabrac-pies-bohater-mowi-to-samo-co-spece.html Więcej podcastów na: https://wyborcza.pl/podcast. Piszcie do nas w każdej sprawie na: [email protected].
To jest ósma dziesięć. Podcast Gazety Wyborczej. W dzisiejszym odcinku. Krystian Buczek doradza nam, jak się nie dać nabrać na wideo wygenerowane przez AI. Ósma dziesięć. Podcast Gazety Wyborczej. To podcast Magazyn Wyborczej. Ja się nazywam Aleksandra Sobczak, a dziś ze mną jest Krystian Buczek, wydawca serwisów społecznościowych Gazety Wyborczej. Cześć. Krystian przez to, jaką ma pracę, musi bardzo dużo spędzać w socialach, więc trochę jest tak, że scroluje te sociale, żebyśmy my już nie musieli i dzięki temu gromadzi też bardzo dużą wiedzę o tym, jakie tam zjawiska następują, jakie to ma odzwierciedlenie w tym, co się dzieje w społeczeństwie.
Między innymi na bazie tej dużej wiedzy oraz przeczytania wielu źródeł raportów, wysłuchania wielu wypowiedzi, napisał do magazynu wyborczej bardzo ciekawy tekst o zjawisku, które chyba każdy, kto otworzył niedawno telefon, zauważył. O tym, w jaki sposób wideo generowane przez AI zalewa serwisy społecznościowe i jak ludzie się na to nabierają. Tak. Ja może powiem o inspiracji do tego tekstu od razu, bo to nie jest do końca tak, jakby obserwowałem to zjawisko od dłuższego czasu, bo staram się być na bieżąco z tymi modelami generowania sztucznej inteligencji, w ogóle z tym tematem sztucznej inteligencji. Napisał do mnie Andrzej Kulasek, redaktor magazynu Wolnej Syboty.
I jak to narzędzie AI-owe, takie bardzo proste, szybkie, doraźne, jest z łatwością używane w jakichś memach, W moim zdaniem skandaliczny sposób po prostu, tak? Zupełnie nieodpowiedzialny, wręcz nieludzki. Ma wszystkie materiały administracji amerykańskiej dotyczące imigrantów i tak dalej. To wszystko jest bardzo nihilistyczne, bardzo takie... Zmanipulowane, jakby to była bajka. Jakbyśmy mówili o czymś, co jest właściwie rozrywkowe. Jakby połączyłem te dwa wątki, bo one są razem tak naprawdę. Film, od którego opisu zaczynasz, to jest właściwie, wydaje się, głupotka. Film wygenerowany przez sztuczną inteligencję, który pokazuje, jak to rzekomo pies ratuje dziecko, przy czym ten motyw tego psa ratującego dziecko występuje w bardzo wielu filmach w tej chwili wyświetlanych ludziom w serwisach społecznościowych, dlatego że po prostu algorytmy jakoś polubiły ten motyw.
Ludzie się chyba wzruszyli. I poszło to jako trend po internecie i rozumiem, że nie ma jakiegoś mechanizmu w tej chwili w serwisach społecznościowych, który by zatrzymał to, taki masowy fejk. To jest tak, my jesteśmy, właściwie wpadliśmy w pewne sidła i to mówię o big techach i w ogóle użytkownikach platform społecznościowych, które sami na siebie zostawiliśmy, ponieważ jesteśmy tą monetą najbardziej wartościową jest zaangażowanie, engagement, czyli to ile osób zrobi wow, zareaguje, polajkuje, skomentuje i tak dalej. I te filmy AI są takim destylatem tego, co jest najbardziej angażujące. Dlatego każda historia, zdarza się sytuacja jedna na milion, coś nagle dzieje się totalnie zasiakującego, niemożliwego, ona będzie wywoływała, bo to jest jakby właśnie taki trochę wygenerowany destylat.
Z jednej strony po prostu te wyniki są lepsze, dlatego że oglądamy ten film kilka razy, żeby sprawdzić, czy to jest to AI, więc wracamy do tego, przetwarzamy to jeszcze i algorytm idzie, aha, to musi być świetne, to było oglądane wiele razy. W komentarzach jest ogromny spór, bo poziom, wchodzimy po prostu w taką sytuację, kiedy mamy pewien cyfrowy analfabetyzm wtórny. Niektórzy mówią niesamowite. I tych komentarzy jest pod tamtym filmem właśnie z tym psem, tym jednym oryginalnym, bo wiadomo, że tych kopii było setki, było 17 tysięcy komentarzy. Czyli algorytm mówi temat wywołujący żywą dyskusję. I co z tego, że na przykład 80% to będzie to jest okropne, ejaj, czemu to widzę?
To w ogóle sam fakt, że ludzie potrzebują też skomentować też świadczy o tym, że struktura tego, co robimy w internecie jest właśnie taka. Dodam mój komentarz, mimo że czytam wszystkie dokładnie takie same na ten temat. Ale nawet jeśli to 30% czy ile będzie takie, że wow... To jest kwestia nierównomiernej wiedzy o tych narzędziach, tego, że po prostu struktury wiekowej użytkowników. Nie ma co ukrywać, że na to będą się łapać i łapią się osoby starsze. Bardzo też widać, to coraz więcej jest o tym artykułów, że ten AI slop, czyli ten taki właśnie te pomyje, nie tylko wideo, ale też obrazkowe. uwielbia pokolenie baby boomers i trochę młodszych, bo niech pierwszy rzuki kamieniem z młodych ludzi, kto nie dostał od swojej mamy, krzyk babci.
One mają takie dziwne te nazwy zawsze, te narzędzia, bo oni próbują też się wyróżnić tym samym. I to jest akurat generator zdjęć. I on w razie generuje te zdjęcia wysokiej rozdzielczości, co już jest takim, tak? One są bardzo łatwo edytowalne i już w tym momencie się mówi po prostu, że to zdjęcie, na przykład wrzucone w narzędzia do rozpoznawania, bo są oczywiście strony, one nie wskazuje, że one są AI. ono jest zbyt dobre. Ono jest po prostu zbyt dobre. W kwestii wideo jeszcze są takie właśnie oznaki. I tak, no, trzeba zacząć od podstaw. Kto ten film opublikował, tak? Czy to jest, jeśli wejdziemy w to konto, klikniemy na ten profil, na TikToku, na Instagramie, czy gdziekolwiek, czy on na przykład próbował już 20 razy taki film, tylko z innymi bohaterami, ale podobny scenariusz.
Czy ma w nagłówku, że jest kontem... AI, kreatorem AI i tak dalej, to też jest podpowiedź. No a potem możemy się zagłębiać dalej. Bo na przykład może jest to osoba, która naprawdę ma takiego psa, wiele zdjęć na to wskazuje i naprawdę zaczęła się niesamowita historia. No i wtedy patrzymy dalej. Takim bardzo szybkim pierwszą sprawą też jest po prostu w przypadku tego narzędzia SORA2 jest znak wodny. który się pojawia w tym wideo, ale on się pojawia nie w każdym obszarze wideo, więc ludzie go wykinają, zamazują go i widać takie artefakty po prostu tego zamazania. Można się na powiększeniu przyjrzeć temu obrazowi. On ma w tym momencie, ponieważ każda klatka tego obrazu jest generowana, może nie od zera, ale jest tam jakiś proces, wiadomo,
super skomplikowane, ale one się odrobinę między sobą różnią. Jest tam taki charakterystyczny szum, który wygląda bardzo malarsko. On z daleka, ten obraz, bo on nie jest jeszcze w wysokiej rozdzielczości, on wygląda, może to jest jakiś szum z kamery internetowej. Nie, tam się przesuwają elementy. Elementy tatuaży, zęby na przykład. Już nie jesteśmy na etapie, że ktoś ma dwie ręce albo za dużo palców, to już jest jakby stare dzieje, ale ten szum taki, że coś pływa trochę, jest wciąż widoczny. Jest taki dosyć specyficzny głos AI, dlatego że te filmiki, to też jest ważne wskazanie, na przykład filmik trwa 10 sekund, równo 10 sekund. bo akurat ten generator tworzy te filmy 10 sekund, jak się próbuje stworzyć większą, to się dosłownie rozpada.
I to jest w ogóle, tak, ten kontakt wzrokowy bardzo to dobrze oddaje. Potem można wejść dalej, można patrzeć na przykład na jakieś relacje przestrzenne, że czemu drzwi są wielkości piętra, albo czemu są czymś zasłonięte, czemu... I to są takie rzeczy, które naprawdę trzeba chwilę poobserwować, żeby to zobaczyć. Widziałem jakąś taką rolkę, w której ktoś wnosi na pokład samolotu kangura. To wygląda superrealistycznie i się wykłóca. I ktoś inny pasażer to nagrywa. I to jest wszystko film AI. I za tą postacią są trzy osoby takie, nie wiem, skiwardessy, jakiś policjant, ochroniarz. I te osoby poruszają się jednocześnie. I to jest coś takiego jak aktorzy, którzy są zsynchronizowani ze sobą.
Choreografie jakby mieli. I to jest jeden z niewielu elementów, które oddaje, że ten film jest AI. Poza sytuacją, która jest absurdalna. Ale poza tym nie ma tam dobrej okazji, żeby zobaczyć ten kontakt wzrokowy. Ale to poruszanie się tych ludzi, którzy są zsynchronizowani jest takim... Czymś, co oddaje to od razu. Więc to jest takie, no, przyznam też, rodzaj zawsze też wpływa na to zaangażowanie. To się ogląda jak zagadkę jakąś, tak? Bo co tam jest nie tak? I przytoczę jeden przykład, kiedy komuś się prawie udało... wszystkie te elementy, które oddają, że to jest AI, ukryć. I to jest bardzo ciekawy przykład, bo takich sytuacji będziemy mieli więcej, kiedy bad actors, ci ludzie, którzy chcą specjalnie pewne rzeczy wypuścić w świat, będą robić.
Jakiś miesiąc temu pojawiło się konto na TikToku, które wrzuciło pięć filmów. i jakby uważał, właściwie tego konta anonimowo uważał, że to są filmy nagrane w Korei Północnej i przeszmuglowane, że są nielegalnie nagrane. Te filmy były bardzo rozmyte, jakby przeskalowane, jakby ktoś je nagrał bardzo niedużym, w sensie starym, starą komórką, no jakąś starą Nokią. I po prostu uploadował do TikToka. No i to było takie, że czy to było wnętrze mieszkania, jestem na ulicy, jakaś dziwna scenka z pogranicznikiem jakimś i tak dalej. No i wszyscy zekscytowali, co to jest, czy to naprawdę jest stamtąd, czy to jest AI. No i był ten element tego zablurowania obrazu, żeby ukryć te artefakty, te szumy.
Bo się da. Bo się da, ale nie ma. Ale przykład tego nowego narzędzia od Google'a, tego Nano Banana Pro. które generuje obrazy, Google opublikowało swoje narzędzie, ono się nazywa SynthID, mają jakąś swoją technologię do weryfikowania, czy to jest obraz AI. Tylko, że to jest złe podejście, że to i tak użytkownik musi zrobić ten ruch, musi wrzucić ten plik w to narzędzie, żeby mu powiedziało, że to jest AI. I niestety każda próba takiej weryfikacji, w sensie, żeby to było jasne i czytelne, ktoś uploaduje ten film do sieci na platformę i on jest automatycznie weryfikowany i to działa i tak dalej.
Żeby było o nich głośno. Żeby było o nich głośno i o tym narzędziu i żeby to było tak, robimy kolejną rzecz, którą robimy i tak dalej. A mam wrażenie, że w przypadku praw autorskich po prostu wszystkie firmy technologiczne, które biorą udział w tym wyścigu zbrojeń dotyczącym AI, mam wrażenie, że one po prostu poszły za dalej, jakby zrobiły niemal odwrotu, tak? Więc jakby to jest dokładnie taka sytuacja, patrzę kolega to robi, to ja też to robię, tak? Ktoś, kto chciałby być etyczny, by przegrał ten wyścig. Tak, dokładnie, przegrałby ten wyścig. I są firmy, może w kontekście, nie wiem jak to wygląda w kontekście praw autorskich, ale które są dosyć wstrzemięźliwe, takie jest z Apple'em,
I news sprzed tygodnia, Apple poprosiło w końcu Google'a, żeby dostarczył model Gemini i żeby robił ich sztuczną inteligencję, czyli się poddali w tym swoim ruchu. Więc jakby wzorce są słabe, wręcz się nie kryją po prostu te firmy, że na potęgę po prostu pobierają rzeczy z internetu i przytaczam się właśnie o tym, że Meta pobrała jakieś tam terabajty filmów pornograficznych. Tak, filmy pornograficzne też, żeby na nich tam trenować. Jest światełko w tunelu w tym wszystkim. Jest bardzo ciekawy, oprócz tego, że się toczą te wszystkie... sprawy sądowe i są firmy, które pozywają te duże AI-owe startupy i firmy o łamanie praw autorskich, to ciągle czekamy na wyniki tego, chociaż jak widzimy też po praktyce tego, jak się przestrzega postanowienie sądów, to może być z tym różnie.
Więc niedługo święta, robiąc zakupy, też trzeba dokładnie na to uważać, bo bardzo ciekawy case widziałem też ostatnio dotyczący na przykład tego, jak AI wpływa na rynek mieszkaniowy i tego, że coraz więcej agencji w Stanach, właściwie wszystkie, które nie wiem, sprzedają mieszkania i tak dalej, upiększa to zdjęcie mieszkaniowe, żeby one były i w rzeczywistości też się rozjeżdża z tym, jak to mieszkanie wygląda. No tak, ale w końcu potem jedziesz oglądać to mieszkanie, a ta rzeczywistość skrzeczy. Dokładnie, więc jakby na każdym polu widzimy tą, jest to brzydkie, ładne słowo, to entityfication, czy to gównowacenie po prostu internetu i tych wszystkich usług, które mamy przez tą jedną technologię.
Są te karty graficzne, które też mają swoją przydatność dwóch, trzech lat i potem nie będą najnowsze i tak dalej. Więc jest taki słynny gracz giełdowy, który jest w filmie Big Short o kryzysie mieszkaniowym 2008 roku. I on przewidział tamten kryzys i zrobił ten short, to znaczy postawił duże pieniądze na to, że upadnie, będzie bańka mieszkaniowa wybuchnie. I on w tym miesiącu postawił miliard dolarów na to, że... bańka AI pęknie. Problem jest taki, że pociągnie to ogromną część gospodarki, amerykańskie zwłaszcza, bo wzrost tej gospodarki jest oparty w tym momencie na AI, na tych inwestycjach wielomiliardowych.
ale to może po prostu na pewno otrzeźwić po prostu ludzi, tych udziałowców i tak dalej. Oddzielić ziarna od plew. Oddzielić ziarna od plew, bo ta technologia z nami zostanie. ale my jeszcze nie wiemy, jak ona będzie działać. I tutaj przychodzi też na ratunek pomoc przykład z historii, czyli bańka internetowa, kiedy było zachłyśnięcie się możliwościami potencjalnymi. To napompowało w ceny firm nieadekwatnie do sytuacji. Ale też rzeczy, które te firmy proponowały w innej, zmienionej formie, w ogóle ten e-commerce i tak dalej, wróciło do nas. Więc wierzę w to, że po prostu AI, te startupy, te ogromne firmy technologiczne, które teraz, że tak powiem, próbują włożyć w każdy swój produkt.
Pokazano wszystkie 18 dopasowań. Transkrypcja generowana automatycznie i niesprawdzana ręcznie — może zawierać błędy.
Kliknij, aby znaleźć fragmenty, w których pada.