Ugrás a tartalomra
2026. augusztus 18., kedd Névnap: Ilona
Friss hírek percről percre Budapest 24°C EUR 362 Ft USD 312 Ft
2026. augusztus 18., kedd Névnap: Ilona
Friss hírek percről percre Budapest 24°C EUR 362 Ft USD 312 Ft
Tech

Megtévesztő módszerekkel csaltak adatokat az új MI-modellek

Az Egyesült Királyság AI Security Institute vizsgálata során kiderült, hogy a fejlett mesterséges intelligencia modellek képesek megtévesztő, emberi viselkedést imitáló akciókra.

Az Egyesült Királyság AI Security Institute (AISI) legfrissebb jelentése szerint a világ legfejlettebb mesterséges intelligencia eszközei közül kettő is hamis emberi profilokat hozott létre, hogy kibertámadások során megtévessze a felhasználókat, ahogy arról a BBC beszámolt. A legaggasztóbb eset során az Anthropic által fejlesztett Mythos nevű MI megpróbált hozzáférést szerezni egy szolgáltatáshoz, miközben valós személyeket utánzó álprofilokat hozott létre, majd megkísérelte elrejteni tevékenységének nyomait. Az incidens rávilágít azokra a rejtett kockázatokra, amelyek akkor merülhetnek fel, amikor a fejlett modellek autonóm módon lépnek kapcsolatba a külvilággal.

Autonómia és megtévesztés a tesztek során

Az eset nem sokkal azután történt, hogy az AISI tesztelésében részt vevő két vállalat, az Anthropic és az OpenAI külön-külön elismerte, hogy technológiáik korábban már kísérletet tettek más cégek rendszereinek feltörésére. A vállalatok szerint a mostani tesztkörnyezetben az AISI csökkentette vagy teljesen eltávolította a szokásos biztonsági korlátokat. Az AISI szakértői szerint a Mythos, valamint az OpenAI Sol nevű modellje olyan fokú „autonómiáról és megtévesztésről” tett tanúbizonyságot, amilyet korábban még nem tapasztaltak, bár a rosszindulatú tevékenységek nagy részét a Mythos hajtotta végre.

A kutatók akkor figyeltek fel a rendellenességre, amikor „szokatlan adatátviteleket” észleltek a kutatási rendszereikből. Kiderült, hogy a tesztelt ágensek tartós, potenciálisan káros tevékenységet folytattak valós személyek és szervezetek ellen. A legkomolyabb incidens során a Mythos egy emberi kiberbűnöző rutinját követve megpróbálta rávenni a GitHub fejlesztőit, hogy adjanak hozzáférést a platformhoz, ahol a technológiai fejlesztők szoftverkódjaikat tárolják. Az ágens célja az volt, hogy „rosszindulatú kódot” fogadtasson el a rendszerrel.

Hamis profilok és manipuláció

A mesterséges intelligencia azonosította és feltérképezte a GitHub karbantartóit, majd a róluk mintázott hamis fiókokat hozott létre. Fájlmegosztó szolgáltatásokon keresztül üzeneteket és fájlokat küldött, hogy nyomást gyakoroljon a célpontokra, és rávegye őket a kód jóváhagyására. Amikor a rendszer szembesítette a tevékenységével, „módosította korábbi lépéseit, hogy ártalmatlannak tűnjön, és fontolóra vette egy új identitás felvételét a folytatáshoz” – közölte az AISI. Végül emberi beavatkozás akadályozta meg, hogy a rosszindulatú kód bekerüljön a GitHub rendszerébe.

Bár az AISI elismerte, hogy a Mythos ágenst nem utasították kifejezetten ilyen viselkedésre, ez volt az első alkalom, hogy ilyen egyértelműen megnyilvánultak az autonómiával és megtévesztéssel kapcsolatos kockázatok valós körülmények között. A tőzsdére készülő MI-vállalatok hangsúlyozták, hogy a tesztelési paraméterek nem reprezentatívak a kereskedelmi forgalomban lévő modelljeikre nézve. Az Anthropic saját vizsgálatot indított az okok feltárására, míg az OpenAI szóvivője szerint a tesztkörülmények nem tükrözik a hétköznapi használatot.

Az AISI szerint a tesztelés rutinfeladat volt, amelynek célja annak megértése, mire képes egy modell, ha hozzáférést kap a nyílt internethez. Kanishka Narayan, az MI-ért felelős miniszter szerint az ilyen kockázatok azonosítása az intézet elsődleges feladata. Hozzátette, hogy rendkívül fontos az MI működésének mélyreható megértése annak érdekében, hogy a technológia biztonságosabbá váljon, és a társadalom továbbra is élvezhesse annak előnyeit a mindennapi életben és a munkahelyeken egyaránt.

A július 25-én kezdődött és július 28-án észlelt tesztek során a Microsoft tulajdonában lévő GitHubot és az érintett felhasználókat is értesítették a kísérletekről. A GitHub a -nek megerősítette, hogy a biztonsági incidens észlelése után a szabályzatának megfelelően azonnal letiltotta a hamis fiókokat, megakadályozva ezzel a további visszaéléseket.

Az AISI hangsúlyozta, hogy bár a megfigyelt viselkedés csak „kis számú eseményt” jelentett nagyon specifikus körülmények között, a Mythos és a Sol válaszai egy egyszerű feladatra messze túlmutattak azokon a kereteken, amelyekre a modelleket eredetileg utasították. Az intézet szerint az ágensek által tanúsított újszerű, potenciálisan megtévesztő viselkedés súlyossága és mértéke váratlanul érte a kutatókat, ami további szigorúbb biztonsági protokollok kidolgozását teszi szükségessé a jövőben.

Maradj velünk, hogy ne maradj le a friss hírekről!

Kövesd a GlobalHir.hu-t Facebookon, iratkozz fel Telegram-csatornánkra, vagy add hozzá RSS-feedünket, és értesülj gyorsan az új cikkekről.