Az OpenAI bemutatta a „határsebességű” fejlesztést
Az OpenAI a napokban leleplezte régóta várt Ultrafast elnevezésű API-szolgáltatását, amely a Cerebras technológiájára építve drasztikus sebességnövekedést biztosít a zászlóshajónak számító GPT-5.6 Sol modell számára. Az újításnak köszönhetően a válaszadási idő akár 14-szeresére is gyorsulhat a hagyományos megoldásokhoz képest, ami másodpercenként elképesztő, 750 tokenes sebességet jelent. A januárban bejelentett stratégiai együttműködés keretében a két vállalat összesen 750 MW-nyi, kifejezetten a gyorsaságra és az alacsony késleltetésre optimalizált számítási kapacitást különített el, ezzel új szintre emelve az LLM-ek teljesítményét.
A technológiai áttörés hatékonyságát mi sem bizonyítja jobban, mint a Humanity’s Last Exam elnevezésű teszt, amely során a Sol modell az Ultrafast segítségével 11 óra alatt végzett egy 2500 összetett kérdésből álló vizsgasorral. Összehasonlításképpen, a korábbi Fable modellnek ugyanezen feladat elvégzéséhez 78 órára volt szüksége, miközben a Sol hasonlóan magas minőségű, precíz eredményeket produkált. A fejlesztők beszámolói alapján az új architektúra nem csupán a végfelhasználói élményt javítja, hanem a belső munkafolyamatokat is forradalmasítja: az egyik OpenAI munkatárs szerint a sebesség már-már a csalással ér fel, míg egy másik kolléga arról számolt be, hogy a biztonsági tesztelési procedúrák idejét sikerült több óráról mindössze 10 percre csökkenteni. Ez a fajta ugrásszerű gyorsulás teljesen átírhatja azt, ahogyan a fejlesztők és az AI-modellek együttműködnek a jövőben.
Az Ultrafast jelenleg még zárt körben, kizárólag meghívásos alapon érhető el API-előzetesként, és bár pontos publikus árlistát még nem hoztak nyilvánosságra, az OpenAI ígérete szerint a hozzáférés a Cerebras kapacitásának bővülésével párhuzamosan egyre szélesebb körben lesz elérhető. Ez a technológiai mérföldkő rámutat az iparág egyik legégetőbb problémájára: a mesterséges intelligencia fejlesztése során eddig folyamatosan az intelligencia és a sebesség közötti kényes egyensúlyozással kellett küzdeni. Most azonban, hogy az AI megkapta a saját turbóhajtóművét, a hangsúly a számítási kapacitás növeléséről a hatékony alkalmazhatóság irányába tolódik el. Az ilyen sebességű autonóm ágensek és munkafolyamatok paradigmaváltást jelentenek az AI-jal való interakcióinkban, hiszen a villámgyors feldolgozási képesség olyan komplex feladatok automatizálását teszi lehetővé, amelyek korábban a hardveres korlátok miatt elképzelhetetlenek voltak. A technológia igazi értékét a jövőben az árképzés és a skálázhatóság határozza majd meg, de a mostani eredmények alapján az OpenAI és a Cerebras közös projektje alapjaiban változtathatja meg az AI-iparág jövőjét.
- Az OpenAI és a Cerebras eredetileg januárban jelentette be az együttműködést, amelynek keretében 750 MW-nyi, a sebességre optimalizált számítási kapacitást különítenek el.
- A „Humanity’s Last Exam” teszten a Sol az Ultrafast használatával 11 óra alatt végzett egy 2500 kérdésből álló vizsgasorral, míg a Fable modellnek ehhez 78 órára volt szüksége, hasonló eredmények mellett.
- Egy OpenAI munkatárs szerint a sebesség „olyan, mintha csalnék a munkámban”, míg egy másik kolléga arról számolt be, hogy a biztonsági vizsgálatok idejét órákról 10 percre csökkentették.
- Az Ultrafast jelenleg csak meghívásos alapon érhető el API-előzetesként, publikus árlista nélkül, az OpenAI pedig azt ígéri, a hozzáférés szélesebb körű lesz, ahogy több Cerebras kapacitás válik elérhetővé.
Az iparág folyamatosan az intelligencia és a sebesség közötti egyensúlyozással küzd, de mi történik, ha a technológia saját turbóhajtóművet kap? A nagy kérdőjel még az ár, de az ilyen sebességű ágensek és munkafolyamatok paradigmaváltást jelentenek majd abban, hogyan lépünk kapcsolatba az AI-jal. ---