Az OpenAI szerint dolgozik azon, hogy könnyebb legyen felismerni az AI által generált szövegeket, miközben az Európai Unió egyre mélyebben beleáll az EU AI Act betartatásába. A nemrég megjelent bejegyzésben a ChatGPT fejlesztője azt magyarázza, hogyan illeszkedik a biztonsággal, átláthatósággal és eredetigazolással kapcsolatos munkája Európa egyre bővülő AI-követelményeihez.
A bejelentés nagy része ismerős témákat érint. Az OpenAI beszél modelltesztelésről, system cardokról, red team gyakorlatokról, kockázatértékelésről és a szabályozó hatóságokkal való együttműködésről. A legérdekesebb rész viszont az, hogy az eddig főleg képeknél használt eredetigazolási megoldásokat hangra és szövegre is ki akarják terjeszteni.
Az eredetigazolás célja, hogy az emberek meg tudják állapítani, honnan származik egy tartalom, és volt-e szerepe AI-nak a létrehozásában vagy szerkesztésében. Az OpenAI azt írja, „dolgozunk azon, hogy az OpenAI rendszereinek eredetigazolási megoldásait mindenféle tartalomtípusra, így szövegre is kiterjesszük, ahogy a szabványok és az eszközök tovább érnek”.
Ez felelősségteljesen hangzik, de a részletek továbbra is nagyon homályosak. A cég már most használja a C2PA Content Credentials megoldást és a Google SynthID technológiáját az AI által generált képeknél. Ezek a metaadatokat olyan beágyazott jelekkel kombinálják, amelyek akkor is megmaradhatnak, ha a metaadatokat eltávolítják.
A szöveg viszont sokkal nehezebb ügy. Másolják, beillesztik, átírják, rövidítik, lefordítják, összefoglalják, és emberi szöveggel keverik. Így bármilyen címke vagy rejtett jel, amit az eredeti kimenethez kapcsoltak, már néhány apró módosítás után is eltűnhet.
Ha őszinték vagyunk, az AI által generált szövegek megbízható megjelölése szinte lehetetlen feladatnak tűnik. Amint a szöveg elhagyja a ChatGPT-t, az ember átírhat pár mondatot, megváltoztathatja a szerkezetet, vagy összekeverheti saját szövegével, és az OpenAI által hozzáadott jel már alig fog számítani.
Ráadásul az OpenAI nem magyarázta el, hogyan működne a tervezett szöveges eredetigazolási rendszer, és mikor válhat elérhetővé. Azt sem közölték, hogy a jövőben minden egyes ChatGPT-válasz tartalmazna-e valamilyen címkét vagy gép által olvasható jelet.
Az időzítés aligha meglepő. Ahogy az EU AI Act újabb végrehajtási szakaszba lép, az AI-cégekre egyre nagyobb nyomás nehezedik, hogy megmutassák a szabályozóknak: a generált tartalmak hogyan azonosíthatók, és a folyamatosan fejlődő modellek hogyan vethetők be anélkül, hogy még több problémát okoznának.
Az OpenAI a bejegyzést arra is felhasználta, hogy kiemelje kiberbiztonsági programjait, irányítási keretrendszereit és az EU önkéntes Codes of Practice kezdeményezéseihez nyújtott támogatását. Az üzenet elég egyértelmű: az OpenAI azt szeretné, ha az európai szabályozók egy együttműködő, a szigorúbb felügyeletre készülő céget látnának.
Mégis inkább tűnik ez egy megfelelési ígéretnek, mint kész megoldásnak. Az OpenAI azt kéri a felhasználóktól és a szabályozóktól, hogy bízzanak egy címkézési rendszerben, amelyet még nem magyarázott el részletesen, nem mutatott be, és nincs is hozzá megadott kiadási dátum.
Az AI által generált szövegek megjelölése önmagában érthető cél, de az igazi próba azután jön, hogy a szöveg elhagyja a ChatGPT-t. Amíg az OpenAI nem bizonyítja, hogy a jelei túlélnek másolást, szerkesztést és internetes megosztást, ez az egész inkább ígéret marad, mint bizonyíték.

