Anthropic jelentés: Az AI-val való visszaélések észlelése és elhárítása (2026. szeptember)
Az Anthropic fenyegetéselemző csapata az elmúlt hónapokban több olyan műveletet azonosított és szakított meg, amelyek során rosszindulatú szereplők a Claude-ot próbálták felhasználni káros tevékenységekhez. Ez a jelentés esettanulmányokat mutat be ezen akciókról, és leírja, hogyan fejlődött a Claude-dal való visszaélés a vállalat korábbi jelentései óta. A dokumentum a 2025. december és augusztus közötti incidenseket fedi le. A visszaélések egyike sem érintette a Claude Fable vagy Mythos-osztályú modellek használatát.
Kapcsolódó hírek
Az ágensmemória megértése
2026. augusztus 21.