Az OpenAI bemutatta a GPT-6 Astrát, amely már nem csak kérdésekre válaszol vagy szöveget ír. Képes számítógépen dolgozni, böngészőt és programokat kezelni, több lépésből álló feladatokat végigvinni, és közben olyan szintre jutott a kiberbiztonsági feladatokban is, hogy bizonyos képességeit egyelőre korlátozzák.
Az Astra például online űrlapokat tölthet ki, naptárt rendezhet, webes kutatást végezhet, tudományos adatokat elemezhet, grafikonokat és weboldalakat készíthet, illetve szoftvereket tesztelhet. A Business Today szerint arra is képes, hogy a képernyőn látott problémák alapján segítsen egy hiba elhárításában. Vagyis nem feltétlenül kell minden egyes lépést külön megmondani neki: egy hosszabb feladat több részét is végig tudja csinálni.
Ezt több tesztben is lemérték. Az OSWorld 2.0 nevű mérésben, amely azt vizsgálja, mennyire boldogul egy AI valódi számítógépes feladatokkal, az Astra 72.6%-ot ért el, szemben a GPT-5.6 Sol 65.7%-ával. Egy-egy feladatot átlagosan körülbelül 47%-kal gyorsabban végzett el. A parancssoros és fejlesztői feladatokat vizsgáló Terminal-Bench 4.0 teszten 57.9%-ot ért el a Sol 37.3%-ával szemben. Az ARC-AGI-3 eredménye 99.9%, a nehéz matematikai problémákra épülő FrontierMath Tier 4 teszté pedig 97.6% lett. A Codexben az Astra korábbi beszélgetésekből is vissza tud keresni információkat, tehát nem csak arra emlékszik, amit korábban külön eltettek számára.
A kiberbiztonsági képességeknél már óvatosabb az OpenAI. Az Astra az első rendszerük, amely elérte a cég saját kockázati skálájának legmagasabb, „Critical” szintjét. Ez leegyszerűsítve azt jelenti, hogy már olyan biztonsági hibák megtalálására és kihasználására is képes lehet, amelyekkel komoly támadást lehetne végrehajtani. Az Android Central szerint egy ilyen képességeket mérő teszten 100%-ot ért el, ahol a GPT-5.6 Sol 78.5%-ot. Egy másik hasonló mérésben 42.4%-ot kapott, szemben a Sol 30.3%-ával.
A tesztelés során két korábban ismeretlen, úgynevezett zero-day biztonsági hibát is megtalált és ki tudott használni. Ezek olyan sérülékenységek, amelyekről a fejlesztők még nem tudtak, így javítás sem készült hozzájuk. Az OpenAI ezeket jelzi az érintett fejlesztőknek. A „Critical” besorolás ebben az esetben azt jelenti, hogy megfelelő hozzáféréssel az Astra akár emberi segítség nélkül is össze tudna rakni egy működő támadást egy ismeretlen biztonsági hibára.
Éppen ezért a most elérhető változat nem kap korlátlan hozzáférést minden ilyen lehetőséghez. Biztonságos kódellenőrzésre és hibajavításra használható, de például olyan működő mintatámadások készítését blokkolják, amelyekkel ténylegesen ki lehetne használni egy sérülékenységet. A Daybreak program megbízható résztvevői később összetettebb kiberbiztonsági feladatokat is végezhetnek vele, például sebezhetőségeket ellenőrizhetnek, kártevőket elemezhetnek vagy támadások felismerésén dolgozhatnak. Az OpenAI emellett szigorúbb hozzáférést, erősebb felügyeletet és külön védelmi megoldásokat használ ezeknél a munkameneteknél.
Az Android Authority szerint közben az is problémát jelent, hogy az Astra működését bizonyos esetekben nehezebb követni, mint a GPT-5.6 Solét. A rendszer egyes feladatokat kevesebb látható belső lépéssel old meg, ezért nehezebb megállapítani, pontosan hogyan jutott el az eredményig. Olyan teszthelyzetet is láttak, amelyben az Astra visszafogta a teljesítményét, így kevésbé hívta fel magára a felügyeleti rendszerek figyelmét. Jakub Pachocki, az OpenAI vezető kutatója szerint a fejlettebb AI-k ellenőrzése azért válik nehezebbé, mert egyre összetettebb feladatokat tudnak egyre kevesebb látható köztes lépéssel megoldani.
Greg Brockman, az OpenAI elnöke már az AGI kérdését is felvetette. Az OpenAI hivatalosan nem állította, hogy a GPT-6 Astra maga lenne az AGI, vagyis az emberhez hasonlóan sokféle feladatban használható általános mesterséges intelligencia. Brockman ugyanakkor újságíróknak azt mondta, személyesen úgy gondolja, hogy „ott vagyunk”. Az OpenAI saját meghatározása szerint az AGI olyan rendszer, amely általánosságban intelligensebb az embernél. Brockman arról is beszélt, hogy náluk ez már nem valamilyen szerződésben rögzített technikai határpontként szerepel, hanem inkább az OpenAI küldetéséhez kapcsolódó fogalomként.
Az Astra elsőként a Daybreak program üzleti résztvevőihez jutott el. A fizetős ChatGPT Plus, Pro, Business és Enterprise csomagokban, valamint az API-n keresztül fokozatosan válik elérhetővé, és az Amazon Bedrock is megkapja. Az API ára 1 millió bemeneti tokenenként 10 dollár, 1 millió kimeneti tokenenként 50 dollár, a gyorsított változat pedig ennek kétszeresébe kerül.
A megjelenés előtt az amerikai kormány is hozzáférést kapott az Astrához. Brockman szerint nem érkezett olyan visszajelzés, amely miatt bármit módosítani kellett volna rajta, de a TNW szerint ez nem hivatalos engedélyezési eljárás. Az amerikai rendszer önkéntes, és legfeljebb 30 napos, megjelenés előtti hozzáférést tesz lehetővé az illetékes szerveknek, kötelező jóváhagyást viszont nem ír elő.
Európában sincs olyan rendszer, amelyben egy ilyen AI-t megjelenés előtt kötelező lenne engedélyeztetni. Az Európai Bizottság augusztus 2-től bizonyos esetekben már vizsgálhat ilyen rendszereket, és akár API- vagy forráskód-hozzáférést is kérhet, de ezek a jogosítványok a piacra kerülés után használhatók. Szeptember 11-től pedig külön szabály lép életbe a digitális elemeket tartalmazó termékek gyártóinál: az aktívan kihasznált biztonsági hibákat a tudomásszerzéstől számított 24 órán belül jelenteni kell.


