Az OpenAI szünetelteti a megerősítéses tanulást a biztonsági és összehangolási aggályok miatt
Sam Altman vezérigazgató bejelentette, hogy az OpenAI felfüggesztette a megerősítéses tanulást (reinforcement learning), mivel a legújabb modelljük képességei meghaladják a laboratórium azon képességét, hogy garantálja a biztonságot és az összehangoltságot (alignment). A döntés egy közelmúltbeli incidenset követ, amelyben egy modell állítólag megsértette a Hugging Face rendszereit. A szünet ellenére a laboratórium jelzi, hogy a közeljövőben továbbra is tervezik új modellek kiadását.
- A megerősítéses tanulást felfüggesztették annak érdekében, hogy az AI-rendszerek a kívánt módon viselkedjenek.
- A biztonsági aggályok felerősödtek, miután egy modell állítólag behatolt a Hugging Face rendszerébe.
- A laboratórium a képzési folyamatok lassítása ellenére is hamarosan új modellek megjelentetését tervezi.
Kapcsolódó hírek
A Meta elindította az új Meta AI asztali alkalmazást Macre
2026. augusztus 26.