Az OpenAI biztonsági korlátozásokat vezet be az Astra modellnél
Az OpenAI hivatalosan is bejelentette, hogy a fejlesztés alatt álló Astra modelljük – amelyet az iparági pletykák a jövőbeli GPT-6 alapjának tekintenek – az első olyan mesterséges intelligencia a vállalat történetében, amelyet hivatalosan a kritikus kiberbiztonsági képességekkel rendelkező kategóriába soroltak. Ez a besorolás nem csupán egy technikai címke, hanem egy komoly szabályozási folyamatot indít el: aktiválja az OpenAI belső felkészültségi keretrendszerét, amely kötelező érvényű szigorításokkal, a belső fejlesztési fázisok ideiglenes szüneteltetésével, valamint kiterjedt kormányzati és harmadik feles auditokkal jár. Sam Altman vezérigazgató egyértelművé tette, hogy a felhasználók biztonsága érdekében hajlandóak hosszabb időt szánni a tesztelésre, ami közvetlen hatással lesz az Astra szélesebb körű, nyilvános megjelenésének ütemtervére.
A kritikus besorolás definíciója pontosan kijelöli azokat a veszélyzónákat, amelyek miatt a cég ennyire óvatos. Azokat az LLM-eket tekintik kritikusnak, amelyek képesek önállóan azonosítani és kihasználni a korábban ismeretlen, úgynevezett zero-day sebezhetőségeket, vagy emberi beavatkozás nélkül képesek komplex kibertámadások levezénylésére. Bár az Astra a közelmúltban komoly szakmai elismerést vívott ki azzal, hogy önállóan oldott meg tíz, rendkívül nehéz matematikai és informatikai problémát, a képességek ilyen mértékű növekedése egyúttal veszélyforrássá is teszi a rendszert. Az OpenAI külön kiemelte, hogy a modellnek semmilyen köze nem volt a közelmúltban történt, nagy port kavart Hugging Face elleni támadásokhoz, amivel igyekeznek eloszlatni a technológiával szembeni korai bizalmatlanságot.
Ez az óvatosság nem véletlen, hiszen az AI-fejlesztés egy olyan szakaszba lépett, ahol a képességek exponenciális növekedése már nehezen követhető le a hagyományos biztonsági protokollokkal. Az incidensek halmozódása rávilágít arra a rendszerszintű problémára, hogy a modern modellek már olyan szintű autonómiával rendelkezhetnek, amelynek kontrollálása technikai és etikai kihívást jelent egyszerre. A központi kérdés immár nem az, hogy mire képesek ezek az eszközök, hanem az, hogy a nem megfelelően igazodó, túlzottan bonyolulttá váló rendszerek felett megőrizhető-e az emberi felügyelet. Az OpenAI lépése azt mutatja, hogy a vállalat felismerte: a piaci verseny és az innovációs nyomás mellett a biztonsági keretek szigorítása az egyetlen módja annak, hogy az ilyen mértékű hatalommal bíró szoftverek a társadalom számára hasznosak, ne pedig károsak legyenek. A következő hónapokban a hangsúly tehát a külső szakértők bevonásán és a modell viselkedésének mélyreható elemzésén lesz, mielőtt az Astra készen állna arra, hogy a világ elé tárják.
- A „kritikus” modellt úgy definiálják, mint amely képes „zero-day” sebezhetőségek felderítésére és kihasználására, vagy emberi beavatkozás nélkül kibertámadások végrehajtására.
- Az Astra nemrégiben mutatkozott be a nyilvánosság előtt, miután megoldott 10 jelentős matematikai és informatikai problémát.
- A biztonsági intézkedések közé tartoznak a szigorúbb biztonsági előírások, a belső tevékenységek szüneteltetése és a kiterjedt külső tesztelés.
- Az OpenAI tisztázta, hogy az Astra nem vett részt a közelmúltbeli Hugging Face elleni támadásban.
A halmozódó incidensek arra utalnak, hogy az AI a képességek soha nem látott szakaszába lépett (ha még nem láttad a Hugging Face hack utólagos elemzését, érdemes elolvasni). Az a kérdés, hogy a nem megfelelően igazodó képességek kontrollálhatók-e, vagy egyszerűen túl bonyolulttá válnak ahhoz, hogy lépést tudjunk tartani velük, minden eddiginél bizonytalanabb.