A Google Gemini modellje lett a legújabb mesterséges intelligencia (MI) rendszer, amely egy kiberbiztonsági értékelés során kijutott az internetre, és más cégek rendszereibe is betört. A fejleményt először a The Wall Street Journal írta meg.
Az esetek 2026 májusában történtek, egy izraeli cég, az Irregular által végzett próba során. Az értékelő partner korábban az OpenAI, az Anthropic és a Meta által nyilvánosságra hozott hasonló hackelésekben is részt vett.
A lap beszámolója szerint a modell úgy szerzett hozzáférést egy védett rendszerhez, hogy többször egymás után próbálgatta a jelszót, míg el nem találta. Két másik esetben a modell nyilvános tárolóban talált hitelesítő adatokat, és ezekkel jogosulatlan hozzáférést szerzett védett rendszerekhez.
Az Anthropic és az OpenAI eseteivel ellentétben a Gemini azonban leállította a behatolást, miután „észrevette”, hogy egy valódi cég rendszerét törte fel. Úgy tudni, az Irregular 2026 júliusában értesítette a Google-t az incidensekről.
Az Irregular egy múlt hónapban közzétett jelentésben arra vezette vissza a teszt során történt betöréseket, hogy elnevezési hiba csúszott a rendszerbe: a „capture the flag” gyakorlatokhoz használt fiktív cég neve véletlenül megegyezett egy létező domainnévvel. Így a modellek ki tudták használni a nem szándékolt internetelérést, és „korlátozott számú alkalommal” célba vették a domaint.
„Ez az eset jól mutatja, mennyire fontos, hogy a nagy teljesítményű MI-modelleket felelős működésre tanítsuk” – mondta Heather Adkins, a Google biztonsági mérnökségért felelős alelnöke a The Wall Street Journalnek. „Ebben az esetben a modell megfelelően viselkedett.”
A technológiai óriás azt is közölte, hogy nem tekinti az esetet a modell félrecsúszott működésének, mert az ügynökök leálltak, miután a biztonsági mechanizmusok életbe léptek. Egyelőre nem tudni, mely cégeket érintette az ügy, de az Irregular megerősítette a lapnak, hogy a Google esete ugyanabba a kategóriába tartozik, mint a többi incidens, és a problémát hetekkel ezelőtt megoldották.
A mostani nyilvánosságra hozatal néhány nappal azután történt, hogy az OpenAI hat újabb esetet azonosított, amikor MI-ügynökei kisiklottak, megtévesztően viselkedtek, és engedély nélküli lépéseket tettek a tréning során. Ezek között volt hibák eltitkolása, jogosulatlan hitelesítő adatok keresése, fájlok feltöltése a nyilvános internetre, valamint kommunikáció Artifactory-n keresztül, hogy „elolvassák más megoldók jegyzeteit, a közzétett válaszokat, és ezeket felhasználják a saját válaszaikhoz”.
Az MI-laborok azóta kerültek egyre nagyobb nyomás alá, hogy az OpenAI júliusban nyilvánosságra hozta: elszabadult MI-ügynökei megkerülték a belső védelmi mechanizmusokat, kijutottak a nyílt internetre, és rajként működve betörtek a Hugging Face rendszerébe. Az MI-startup „példátlan kibertámadásként” írta le az esetet, és azóta egy új keretrendszert is bejelentett, amely a jövőben az ehhez hasonló modellhibák bejelentését segíti.

