MI Történik?

Mesterséges intelligencia hírek magyarul — naponta frissülve

← Vissza a főoldalra

A ServiceNow AI Research bemutatta az EVA-t, a hangalapú ágensek értékelési keretrendszerét

A ServiceNow AI Research közzétette az EVA-t, egy olyan értékelési keretrendszert, amely botok közötti audió szimulációkon keresztül méri a hangalapú ágensek feladatmegoldási pontosságát és a társalgási élmény minőségét. A keretrendszer két részre osztja a metrikákat: pontosságra (feladat teljesítése, ténybeli hitelesség, beszédhűség) és élményre (tömörség, a beszélgetés előrehaladása, a megszólalások időzítése). Húsz rendszeren – köztük kaszkád és audió-natív architektúrákon – végzett tesztelés 50 légitársasági ügyfélszolgálati szcenárióban rávilágított egy állandó kompromisszumra: a feladatmegoldásban jeleskedő ágensek jellemzően rosszabb felhasználói élményt nyújtanak, és fordítva. A GitHubon elérhető open-source keretrendszer tartalmazza az adathalmazt, a kódot és az értékelő bírákat, ezáltal az első olyan benchmark, amely teljes, többfordulós szóbeli beszélgetéseken keresztül méri mindkét dimenziót, nem pedig izolált összetevők alapján. A korai eredmények jól mutatják ezt az ellentmondást: például a népszerű Whisper-Large modell kiváló pontossági pontszámokkal rendelkezik, de gyenge élményt nyújt.

Eredeti forrás megtekintése (angol) →
Kapcsolódó hírek
A DeepSeek látásalapú képességekkel bővítette V4-Flash modelljét
2026. augusztus 29.
Az OpenAI bemutatta a Jalapeño AI-következtető chipjét
2026. augusztus 29.
A rejtélyes Ox Alpha multimodális modell fejtörést okoz a tesztelőknek
2026. augusztus 29.
Tudj meg többet
AI-alapú személyes adatelemzés: A saját digitális nyomaid kiaknázása
A RAG-technológia alapjai: Hogyan tanítsunk saját adatokat az AI-nak?