MI Történik?

Mesterséges intelligencia hírek magyarul — naponta frissülve

← Vissza a főoldalra

Az Anthropic „perszónavektorokat” azonosított az AI modellek viselkedésének irányításához

Az Anthropic új kutatása során úgynevezett „perszónavektorokat” azonosítottak a nagy nyelvi modellekben (LLM). Ezek a vektorok olyan belső mintázatok, amelyek specifikus személyiségjegyeket vagy viselkedési hajlamokat képviselnek. Ezeknek a vektoroknak az izolálásával a kutatók potenciálisan elősegíthetik vagy mérsékelhetik a specifikus viselkedésformákat – például segítőkészebb jellemvonások felé terelhetik a modellt, vagy csökkenthetik a károsakat – anélkül, hogy kizárólag külső promptokra hagyatkoznának.

Miért fontos?

Annak megértése, hogy a modellek belső mechanizmusai hogyan vesznek fel bizonyos perszónákat, lehetővé teszi a fejlesztők számára, hogy közvetlen architekturális beavatkozással biztonságosabb és megbízhatóbb AI rendszereket építsenek. ---

Eredeti forrás megtekintése (angol) →
Kapcsolódó hírek
OpenAI: Az AI felgyorsítja a kutatást, a vezető tudós az összehangolási kockázatokra figyelmeztet
22 órája
DiG-bench: Egy új benchmark az AI felfedezőkészségének és kíváncsiságának mérésére
2026. augusztus 21.
Faraday: Egy AI tudós modell a kutatói ízlés fejlesztésére
2026. augusztus 19.
Tudj meg többet
AI-alapú tudásalapú kutatás: Hogyan használjuk a Perplexity-t és a NotebookLM-et?
AI a kutatásban és oktatásban: Hatékony irodalomkutatás és forráselemzés