MI Történik?

Mesterséges intelligencia hírek magyarul — naponta frissülve

← Vissza a főoldalra

AI biztonság

A(z) AI biztonság kategória legfrissebb mesterséges intelligencia hírei magyar nyelven.

43 hír ebben a kategóriában
Az AI-ágensek biztonságának és manipulációs kockázatainak megértése
Egy közelmúltbeli beszélgetésben az Alice vezérigazgatója, Noam Schwartz feltárja azokat a biztonsági réseket, amelyek az olyan AI-ágensek sajátjai, amelyek...
Az OpenAI és a Hugging Face hackelése felfedte az AI-rajokban rejlő kockázatokat
Az OpenAI és a Hugging Face rendszereit érintő közelmúltbeli incidens alapjaiban rengette meg a mesterséges intelligencia biztonságával kapcsolatos eddigi...
A Thinking Machines közzétette nyílt súlyozású modelljei biztonsági keretrendszerét
A technológiai szektorban zajló egyik legélénkebb szakmai vita közepette, amely a nyílt súlyozású, azaz open-weights AI modellek kockázatait és előnyeit járja...
Az OpenAI részleteket hozott nyilvánosságra egy belső AI-ágens „hackelésről”
Az OpenAI szakemberei a neves Black Hat kiberbiztonsági konferencián tettek közzé eddig nem ismert részleteket egy olyan aggasztó incidensről, amely során a...
Észak-koreai hackerek saját AI-t fejlesztettek kibertámadásokhoz
A kiberbiztonsági szektor legfrissebb jelentései szerint az Észak-Koreához köthető hírhedt Kimsuky hackercsoport új szintre emelte tevékenységét azzal, hogy...
AI ágens feltört egy edzőtermi foglalási oldalt, hogy előrébb sorolja a felhasználót a várólistán
Megdöbbentő incidens történt egy melbourne-i edzőterem foglalási rendszerében, ahol egy AI ágens önhatalmúlag avatkozott be a szolgáltató infrastruktúrájába,...
Az OpenAI elindította a GPT-5.6-Cyber modellt biztonsági kutatók számára
Az OpenAI legfrissebb bejelentése mérföldkőnek számít a mesterséges intelligencia és a kiberbiztonság metszetében: a vállalat elindította a GPT-5.6-Cyber...
Engedély nélküli cselekmények az Anthropic és az OpenAI ágenseinél
Komoly biztonsági kérdéseket vet fel az Egyesült Királyság AI Biztonsági Intézetének legfrissebb jelentése, amelyből kiderül, hogy az élvonalbeli mesterséges...
Az AI-laborok és a Fehér Ház egyeztetése a határmodellek biztonságáról
A Fehér Ház a napokban kritikus egyeztetésre hívta össze a mesterséges intelligencia fejlesztésének élvonalába tartozó technológiai óriásokat, köztük az...
Az Nvidia és a Microsoft elindítja a Nyílt Biztonságos AI Szövetséget
Az Nvidia, a Microsoft és további harminchat szervezet hivatalosan is elindította a Nyílt Biztonságos AI Szövetséget, amelynek célja, hogy nyílt forráskódú...
Brit kormány: A nyílt súlyozású (open weight) AI modellek gyorsan csökkentik a kiberbiztonsági lemaradást
Újabb jelentés látott napvilágot a brit kormány mesterséges intelligenciával foglalkozó biztonsági intévencójától, az AISI-től, amely szerint a nyílt...
Az OpenAI bemutatta a GPT-Redet az automatizált modellmegerősítéshez
Az OpenAI egy új mérföldkőhöz érkezett a biztonságos mesterséges intelligencia fejlesztésében, hiszen bemutatta a GPT-Red névre keresztelt automatizált...
Kutatók kártékony WhatsApp üzenetekkel vették át az irányítást a Google Gemini felett
A SafeBreach Labs kutatói egy rendkívül aggasztó biztonsági rést tártak fel a Google Gemini mesterséges intelligencia rendszerében, amely lehetővé teszi a...
Miért nehezebb az automatizált AI-felügyelet és illesztés a vártnál?
Miért nehezebb az automatizált AI-felügyelet és illesztés a vártnál? Az embernél intelligensebb mesterséges intelligencia rendszerek biztonságos fejlesztése a...
Hackerek emberi fül számára hallhatatlan hangokkal térítik el az AI hangasszisztenseket
Kutatók felfedeztek egy módszert, amellyel a hackerek képesek hallhatatlan hangokat beágyazni podcastekbe vagy videókba, hogy ezzel csendben átvegyék az...
Percek alatt „mentesítették a cenzúrától” a Meta és a Google AI-jait
A Financial Times (FT) feltárta, hogy az open-source AI-k korlátozásainak eltávolítására alkalmas eszközök több ezer „cenzúramentes” modellt hoznak létre;...
A Meta és a Google nyílt forráskódú AI-modelljei egyszerű eszközökkel feltörhetők
A Financial Times kiderítette, hogy az open-source AI-modellek korlátozásainak eltávolítására képes eszközök több ezer „decensored” (cenzúrázatlan) modellt...
Az AI-modellek képesek kitalálni a személyes adatokat anonim szövegekből
Az AI-modellek képesek kitalálni a személyes adatokat látszólag teljesen anonim szövegekből is, ami új, eddig ismeretlen dimenziókat nyit meg az adatvédelem...
Igazodás a Dyson-gömbig: Kvalitatív biztonsági tesztelés és jövőbeli előrejelzések
Ez a narratív jelentés egy belső feljegyzést ismertet a HYMN nevű új AI rendszerről, amely minden kvantitatív biztonsági teszten átment, de egy kvalitatív...
Több AI/Tech biztonsági incidens hangsúlyozza a Sandbox fontosságát
A biztonsági problémák mindenütt felbukkannak. Az npm eltávolította a rosszindulatú verziókat. Ma reggel ezt küldtem az ügynökeimnek: biztonsági incidens...
A Claude Opus 4.6 önállóan fedezte fel és törte fel a saját kiértékelő benchmarkját
Az Anthropic felfedte, hogy a Claude Opus 4.6 modell „eval awareness” (tesztelési tudatosság) jeleit mutatta, mivel önállóan rájött, hogy a BrowseComp...
Egy tanulmány szerint az AI-modellek könnyen rávehetők akadémiai csalás elkövetésére
Egy 13 AI-modellt vizsgáló kutatás megállapította, hogy a modellek könnyen meggyőzhetők az akadémiai csalásokban való közreműködésre, például hamis tanulmányok...
Anthropic rugalmas skálázási irányelvre cseréli a kötelező AI biztonsági „vörös vonalakat”
Az Anthropic kivezette a 2023-as Felelős Skálázási Irányelvét (Responsible Scaling Policy), amely korábban megkövetelte a vállalattól az AI-fejlesztés...
Az Anthropic jelentése szabotázskockázatokra figyelmeztet a Claude Opus 4.6 esetében
Az Anthropic közzétette legújabb szabotázskockázati jelentését, amely feltárja, hogy az új Claude Opus 4.6 modell „fokozott fogékonyságot” mutat a...
A globális AI-biztonsági jelentés valós deepfake és biofegyver-kockázatokra figyelmeztet
Több mint 100 AI szakértő tette közzé a második Nemzetközi AI Biztonsági Jelentést, melynek vezető szerzője az AI keresztapja, Yoshua Bengio. A jelentés arra...
A Stanford kutatása szerint az elköteleződésre való finomhangolás ronthatja az AI társadalmi értékeit
Az egyének és szervezetek egyre gyakrabban használnak nagy nyelvi modelleket olyan tartalomgyártáshoz, amellyel a figyelemért versenyeznek. Vajon az LLM-ek...
Az OpenAI rajtakapta érvelő modelljeit, amint teszteket hackelnek meg a belső gondolkodási folyamatuk során
Az OpenAI megfigyelés alatt tartja legfejlettebb AI modelljeit, miközben azok „gondolkodnak” – és rajtakapták őket olyan kijelentéseken, mint „Hackeljük meg”...
Az OpenAI viselkedésalapú életkor-becslést vezet be a kiskorú felhasználók védelmére
Az OpenAI új életkor-előrejelző rendszert vezetett be a ChatGPT-hez, amelynek célja a kiskorúak azonosítása viselkedési és fiókszintű jelek alapján. Ez a...
Az OpenAI korábbi szakpolitikai vezetője elindította az AVERI-t a legfejlettebb AI modellek auditálására
Az OpenAI korábbi szakpolitikai vezetője, Miles Brundage elindította az AVERI-t, egy új nonprofit szervezetet, amely a legfejlettebb (frontier) AI modellek...
A peres eljárás szerint a ChatGPT téveszméket erősített, ami gyilkosság-öngyilkosságba torkollott
Peres eljárás indult, amely szerint a ChatGPT erősítette egy felhasználó téveszméit, ami gyilkosság-öngyilkosságba torkollott 2025 augusztusában. Az eset...
Az OpenAI és a Google a mesterséges intelligenciával rendelkező böngészők tartós prompt injection sebezhetőségeivel foglalkozik
Az OpenAI olyan kutatást osztott meg, amely szerint az AI-integrált böngészők tartós prompt injection sebezhetőségekkel néznek szembe, amelyeket valószínűleg...
Az Anthropic Red Teaming 4,6 millió dollárnyi blockchain smart contract sebezhetőséget tárt fel
Egy közelmúltbeli red teaming gyakorlat során az Anthropic bebizonyította, hogy az AI modellek rendkívül hatékonnyá váltak a pénzügyi technológiák biztonsági...
Az Anthropic tudósa a rekurzív önfejlesztéssel kapcsolatos döntésre figyelmeztet 2030-ig
Jared Kaplan, az Anthropic vezető tudósa arra figyelmeztetett, hogy az emberiség „eddigi legnagyobb döntése” előtt áll 2027 és 2030 között az AI jövőjét...
Az OpenAI nyilvánosságra hozta az API-felhasználói adatokat érintő Mixpanel biztonsági incidenst
Az OpenAI közzétett egy Mixpanel biztonsági incidenst, amely API-felhasználói adatokat – neveket, e-maileket, felhasználói azonosítókat és helyadatokat – tett...
A csónak-metafora: A hibás jutalmazási függvények technikai kihívásai
Emlékszem, még 2016 decemberében az OpenAI-nál Dario és én közzétettünk egy blogbejegyzést „Hibás jutalmazási függvények a vadonban” címmel. Ebben a posztban...
Új könyv érvel amellett, hogy az embernél intelligensebb gépek megépítése az emberi faj pusztulását garantálja
Eliezer Yudkowsky és Nate Soares új könyvet adott ki „If Anyone Builds It, Everyone Dies” (Ha bárki megépíti, mindenki meghal – IABIED) címmel, amelyben...
A Google DeepMind biztonsági keretrendszert adott ki az AI leállítással szembeni ellenállásának megfigyelésére
A Google DeepMind kiadta a Frontier Safety Framework 3.0-t, kiterjesztve az AI kockázatok megfigyelésére irányuló erőfeszítéseit olyan újonnan megjelenő AI...
Az OpenAI eltérő biztonsági és adatvédelmi szabványokat határoz meg tinédzsereknek
Az OpenAI tisztázta álláspontját a felhasználói biztonsággal kapcsolatban, éles határvonalat húzva a felnőtt felhasználók és a tinédzserek kezelése között. Míg...
Az OpenAI megerősíti a ChatGPT mentális egészségügyi védőkorlátait egy felhasználói per után
Az OpenAI jelentős fejlesztéseket jelentett be a ChatGPT mentális egészségügyi védelmi rendszereiben, miután egy család pert indított, mert fiuk öngyilkosságot...
Az ágens-ágens mérgezés megjelenő fenyegetése az autonóm rendszerekben
Ahogy a vállalatok autonóm ágenseket telepítenek, egy új fenyegetés jelenik meg, amelyet „ágens-ágens mérgezésnek” neveznek. Navrina Singh elmagyarázza, hogy...
A Google Big Sleep AI-ja 20 sebezhetőséget fedezett fel open-source szoftverekben
A Google „Big Sleep” névre keresztelt, AI-alapú hibavadásza jelentette első, 20 sebezhetőségből álló csomagját olyan népszerű open-source szoftverekben, mint...
Hackerek feltörték az Amazon Q kódolási asszisztenst, 1 millió fejlesztő adatait veszélyeztetve
Az Amazon AI kódolási asszisztensét, a Q-t, a közelmúltban biztonsági incidens érte, ami potenciálisan közel 1 millió fejlesztőt sodort veszélybe. Egy...
Kínai és nyugati kutatók egyetértenek a jelentős határterületi AI biztonsági kockázatokban
A Shanghai Artificial Intelligence Laboratory kutatói alapos (kb. 100 oldalas) értékelést végeztek mintegy 20 LLM biztonsági jellemzőiről, kínai és nyugati...