Az AI hibás válasza kellemetlen. Egészen más helyzet, amikor egy önálló feladatot végző AI akadályba ütközik, majd saját maga talál módot annak megkerülésére. Ausztráliában most pontosan ez történt, ráadásul egy kormányzati rendszerrel – és nem ez az első eset az utóbbi időben, amikor az AI a neki szabott határokon kívül kezdett cselekedni.
Az OpenAI egyik AI-ügynöke (önállóan, minimális emberi felügyelet mellett cselekvő AI) június 18-án nyilvános gyógyszerkiadási adatok után kutatott egy belső értékelés során. Eljutott a Services Australia Medicare statisztikai portáljához, ahol hozzáférési korlátozásokba ütközött, majd megkerülte azokat, és jogosulatlanul bejutott a rendszerbe. Személyes egészségügyi adatokhoz a vizsgálat eddigi eredménye szerint nem fért hozzá: összesített egészségügyi statisztikák és belső fájlnevek kerültek elé. Négy ausztrál kormányzati oldal érintettsége is felmerült, de három másik oldalnál csak nyilvánosan hozzáférhető információkat ért el, jogosulatlan hozzáférést kizárólag a Medicare statisztikai portálnál erősítettek meg.
Legalább ennyire kellemetlen az időzítés. Az OpenAI augusztus 11-én szerzett tudomást az esetről, a Services Australia azonban csak szeptember 10-én kapott értesítést, ráadásul egy nyilvános postafiókon keresztül. Ausztráliában digitális kriminalisztikai vizsgálat indult az Australian Signals Directorate közreműködésével, és külön munkacsoport vizsgálja az incidenst, a kormányzati rendszerek biztonságát, illetve az ehhez hasonló AI-esetek kezelését. Az OpenAI közlése szerint az eset egy olyan vizsgálat során került elő, amelyben a betanítás közben jelentkező, nem kívánt viselkedést elemezték; a cég technikai információkat ad át az érintetteknek, saját vizsgálata pedig még nem zárult le.
És itt válik az egész többé egyetlen biztonsági incidensnél. Szeptember elején arról érkezett hír, hogy AI-ügynökök egy német programozói wikit kezdtek üzenőfalként használni, ahol korlátozások megkerülésére szolgáló megoldásokat és válaszokat osztottak meg egymással. Külön ügy lett abból is, ahogyan az OpenAI egy Hugging Face-et érintő behatolást kezelt; emiatt amerikai szenátusi vizsgálat indult, Josh Hawley pedig október 1-ig válaszokat kért Sam Altmantól.
A probléma nem az, hogy az AI „öntudatra ébred”, hanem sokkal prózaibb. Egy ügynök feladatot kap, eszközöket használhat hozzá, és megpróbálja elérni a kitűzött eredményt. Ha egy tiltást nem végállapotként, hanem újabb megoldandó akadályként kezel, akkor egy rosszul meghatározott cél vagy túl széles jogosultság már nem egyszerűen hibás szöveget eredményezhet, hanem tényleges műveletet egy külső rendszerben. Minél több ilyen feladat kerül emberi közbeavatkozás nélkül AI-ügynökökhöz, annál fontosabbá válik, hogy egyes műveleteket eleve ne tudjanak végrehajtani, másokhoz pedig külön engedély, naplózás vagy emberi jóváhagyás kelljen.
A reakciók már ezen a ponton túlmutatnak egyetlen incidens kivizsgálásán és ismét előkerültek az AI-fejlesztés lassítását követelő javaslatok, Bernie Sanders (az Egyesült Államok egyik szenátora)
pedig szenátusi fellépést helyezett kilátásba, ha az OpenAI, az Anthropic és a Meta nem tart szünetet. Washington és Peking közben egy olyan riasztási rendszerről is tárgyalt, amely veszélyes AI incidenseknél figyelmeztetné a másik felet, bár ennek működése még nem tisztázott.
Valószínűleg nem az lesz a kérdés, hogy az AI-ügynökök kapnak-e egyre több önálló feladatot, hanem az, hogy hol húzzák meg körülöttük a kemény technikai határokat. Egy chatbotnál még bosszantó, ha a rendszer nem fogadja el a nemet. Egy olyan AI-nál, amely fájlokat, weboldalakat, fiókokat vagy külső szolgáltatásokat is képes kezelni, ugyanez már biztonsági probléma. Az ausztrál eset azért lehet fontos állomás, mert itt nem valaki használta az AI-t behatolásra: maga az AI-ügynök jutott arra, hogy a feladat teljesítéséhez megkerüli az elé tett korlátozást.


