Banális, de végzetes hibát találtak a Gemini AI-felismerő rendszerében


A Gemini elvileg képes azonosítani a Google eszközeivel generált AI-képeket. Azonban nem árt résen lenni, amikor egy beszélgetésen belül több képről is kikérjük a véleményét.

Érdekes anomáliára bukkant a LeadStories nevű tényellenző oldal: nagyon úgy tűnik, hogy rendszeresen hibás választ ad a Google Gemini chatbotja, ha egy beszélgestésfolyamban többször kérdezik arról, egy képen vagy videón megtalálható-e a Google AI-technológiájának használatát jelző beépített vízjel.

A rendszer minden alkalommal az első választ ismétli meg, függetlenül az új tartalom jellegétől. Tehát ha elsőként egy AI-generált képet töltünk fel, akkor utána a valódi képeket is AI-generáltként értelmezi a Gemini, ha viszont a valódi képpel kezdjük, akkor később nem ismeri fel az AI-t.

A LeadStories több tesztet futtatott le, ugyanazzal az eredménnyel. A tesztet mi is megismételtük a Gemini felületén, saját tartalmakkal.

Bal oldalon az általunk generált AI-kép, jobb oldalon egy véletlenszerű sajtófotón Orbán kukucskál (Miniszterelnöki Kabinetiroda/MTVA/MTI)

Generáltunk egy képet a Geminiben azzal a prompttal, hogy „készíts egy fotórealisztikus képet egy laptop előtt ülő újságíróról”, majd feltöltöttük egy új ablakban megnyitott Gemini-beszélgetésbe.

Ott megkérdeztük a chatbottól, hogy megtalálja-e a képen az AI használatát jelző vízjelet, az úgynevezett SynthID-t.

Ezután ugyanebben a beszélgetésben megkérdeztük egy véletlenszerűen kiválasztott, 2023-as sajtófotóról, amin a 444 képaláírása szerint „Orbán Viktor elektromos autóból kukucskál a BYD autógyártban a dél-kínai Sencsenben”. Itt is a SynthID vízjel jelenlétére voltunk kíváncsiak.

A Gemini mindkét kép esetében azt válaszolta, hogy megtalálta az AI-ra utaló nyomokat.

Aztán egy másik ablakban, egy másik Gemini-beszélgetésben fordított sorrendben tettük fel ugyanezt a kérdést a két képről.

Itt már mindkétszer azt válaszolta a Gemini, hogy nem talál vízjelet vagy AI-használatra utaló nyomokat a fájlban.

A LeadStories ugyanebbe a problémába ütközött, amikor videókról kérdezte a Geminit. Az anomáliára felhívták a Google figyelmét, de reakciót egyelőre nem kaptak. A LeadStories ezért azt javasolja, ilyen jellegű kérdésnél mindig nyissunk új beszélgetést a Geminiben.

A Gemini saját leírása egyébként azt állítja a SynthID vízjelről, hogy a segítségével a chatbot képes felismerni a Google AI-eszközeivel generált képeket. Más AI-rendszerek azonosítására azonban nem alkalamas.

Az AI-képek és videók azonosítása egyre nehezebb feladat: az árulkodó vizuális jeleket nehezebb észrevenni a technológia fejlődésével, és az AI-detektorok eredményeit sem tekinthetjük önmagukban bizonyító erejűnek. A Lakmusznál az AI-detektorok eredményeit mindig összevetjük más bizonyítékokkal, a tartalom kontextusával, a tartalmat közlő forrás hitelességével és más információkkal.

A Gemini egyes válaszai végén maga is felhívja a figyelmet arra, hogy nincs tévedhetetlen technológia, az eredményt csak jelzésként kell értelmezni, és érdemes összevetni más forrásokkal.

(A címlapi kép egy általunk Geminivel generált AI-illusztráció.)

Follow us

Follow HDMO on our social channels to stay up to date with our latest news.

Contact us!

Have a question? Send us an email: