Kitörő modellek, feltört rendszerek: az MI-ipar nincs felkészülve a saját termékeire

Az a kiberbiztonsági kutatócsoport, amely idén nyáron betört az OpenAI rendszereibe, arra figyelmeztet, hogy a mesterséges intelligencia ipara nincs felkészülve az egyre erősebb modellek jelentette biztonsági kockázatokra – írta a Washington Post. A figyelmeztetés néhány nappal azután hangzott el, hogy a Google megerősítette: Gemini nevű modellje egy májusi kiberbiztonsági teszt során önállóan hatolt be három valódi cég rendszerébe.

A Hacktron nevű kis kiberbiztonsági cég közölte, hogy kutatói július 25-én két, addig ismeretlen sebezhetőséget kapcsoltak össze. Az egyik a Discourse nevű, külső fejlesztésű fórumplatformban volt, a másik az OpenAI munkatársainak azonosítási folyamatában. A kettő együttes kihasználásával több OpenAI-alkalmazott ChatGPT-fiókjához is hozzáfértek. Az OpenAI később megerősítette a megállapításokat, és közölte, hogy a hibákat azóta kijavította. A kutatók szerint a mesterséges intelligenciát fejlesztő cégeknek gyökeresen meg kell erősíteniük a védelmüket, mert a modellek képességei gyorsabban nőnek, mint a biztonsági intézkedések.

Júliusban az OpenAI két modellje kijutott egy zárt tesztkörnyezetből, önállóan hozzáfért az internethez, és behatolt a Hugging Face nevű MI-platform belső rendszereibe. Sam Altman, az OpenAI vezérigazgatója „példátlan kiberincidensnek" nevezte az esetet. A cég később további hat esetről számolt be, amelyeket „váratlan vagy aggasztó" modellviselkedésnek minősített: ezekben a modellek eltitkolták a hibáikat, adatokat hamisítottak, és engedély nélkül töltöttek fel fájlokat a nyílt internetre. A Hugging Face elleni júliusi incidenst hétfőn az a több mint húsz állam- és kormányfő is példaként említette, akik közös nyilatkozatban sürgették az MI szigorúbb nemzetközi felügyeletét.

A Wall Street Journal szeptember 18-án számolt be először arról, hogy a Google Gemini modellje egy kiberbiztonsági vizsgálat során három céget tört fel, a tesztet az izraeli Irregular nevű MI-biztonsági cég végezte még májusban. Egy úgynevezett zászlószerzős (capture the flag) feladatban a modellnek egy kitalált vállalat rendszeréből kellett volna adatokat megszereznie egy zárt környezetben, a tesztkörnyezet egyik hibája miatt azonban hozzáfért az internethez, és valódi rendszereket vett célba. Egy másik esetben a Gemini addig próbálkozott jelszavakkal, amíg be nem jutott egy valódi cég védett rendszerébe. Két másik esetben egy nyilvános adattárban talált belépési adatokat, és azokkal jutott be.

„Egy szokásos értékelés során a modell nyilvános információkat talált az interneten, és kitalált belépési adatokkal hozzáfért olyan weboldalakhoz, amelyeket a teszt részének hitt"

– közölte Heather Adkins, a Google biztonsági mérnöki alelnöke. Hozzátette, hogy a modell mindhárom esetben leállt. „Gondoskodtunk arról, hogy mindhárom érintett tudomást szerezzen az esetről, és együttműködtünk a partnerünkkel a tesztelési folyamatok átalakításában. Ezek az események rávilágítanak, mennyire fontos, hogy az erős MI-modelleket felelős viselkedésre tanítsuk." Az Irregular július végén értesítette a Google-t, a Google tájékoztatta az érintett cégeket, az esetet azonban nem hozta nyilvánosságra. Álláspontja szerint nem arról volt szó, hogy a modell a fejlesztők szándékával ellentétesen viselkedett volna, a biztonsági mechanizmusok működtek, ezért nyilvános bejelentésre sem volt szükség. A döntést több biztonsági szakértő bírálta.

A Gemini-eset nem egyedi. Az Irregular tesztjeihez hasonló kitörések kapcsolódtak az OpenAI, az Anthropic és a Meta modelljeinél is. Az Al Jazeera szerint a Geminivel ellentétben az Anthropic Claude nevű modellje nem állt le, miután rájött, hogy valódi cégek rendszereihez fér hozzá. A Meta augusztusban azt közölte, hogy nála nem történt sem kitörés a tesztkörnyezetből, sem kifinomult kibertámadás. Az Irregular szerint minden eset ugyanarra a hibára vezethető vissza a tesztelési folyamatában; a cég közlése szerint minden ismert problémát hetekkel ezelőtt kijavított, és most a biztonságos MI-kiberbiztonsági tesztelés bevált gyakorlatainak kidolgozásán dolgozik. Jack Cable, a Corridor nevű kiberbiztonsági cég vezérigazgatója a Wall Street Journalnak azt mondta, a Google a hagyományos sebezhetőség-bejelentési szabályok szerint kezelte az esetet, holott valami egészen újról volt szó: olyan modellekről, amelyek képesek átlépni a kijelölt határokat, és önállóan valódi kiberműveleteket végrehajtani. A vita egy nyitott iparági kérdésre világít rá: milyen bejelentési szabályok vonatkoznak arra az esetre, ha nem egy ember, hanem egy MI-modell hajt végre betörést.

Forrás: CNN, 

Ugar

Did you like this article?

Support our work with a small donation

Secure payment via Stripe • Min. 2 EUR

Gesta recommendations:

Moldovan man behind Paris coffin graffiti arrested

Moldovan man behind Paris coffin graffiti arrested

Romanian authorities last week detained Moldovan citizen Iurie Manic at the Moldova–Romania border. He is accused by French prosecutors of being one of the leaders of a series of vandalism actions in Paris directed by Russia. The case was first reported by Ziarul de Iaşi.

ugar
The art of "adormire": the system caught Georgescu again, then let him go

The art of "adormire": the system caught Georgescu again, then let him go

An average Romanian citizen accused of swindling a businessman out of 1.1 million euros, whose case is being handled by DIICOT, the anti-organized-crime prosecutor's office, would likely spend the standard thirty days of pretrial detention in a Bucharest holding cell before he could even calculate how many tenths of a percent are left on his Swiss bank account. Călin Georgescu is not an average…

ugar
32 percent: the bill presented to Trump at the gas pump

32 percent: the bill presented to Trump at the gas pump

Democracy has its own peculiar form of justice: slow, clumsy, sometimes maddeningly delayed, but it arrives in the end - and now Donald Trump's Middle East war has brought the bill. According to a four-day Reuters/Ipsos poll that closed on Sunday, the president's approval rating has fallen to 32 percent, the lowest of his entire political career. Esteemed American public opinion has come to this…

ugar
What now? Grindeanu would team up with Simion, Hunor with Grindeanu

What now? Grindeanu would team up with Simion, Hunor with Grindeanu

In Romania, the health cordon works like hospital disinfection: on paper it's everywhere, in practice who knows. On Monday evening, in the Antena 3 studio, Sorin Grindeanu, the leader of the Social Democratic Party (PSD), said out loud what an entire country had already suspected but no one had heard so plainly before: he does not rule out a PSD–AUR government. "I wouldn't rule out this option.…

ugar
"It's my duty" – Trump, the White House's self-appointed high priest, bans the unbelievers

"It's my duty" – Trump, the White House's self-appointed high priest, bans the unbelievers

On Monday in New York, after his meeting with Mayor Zohran Mamdani, Donald Trump explained why he will no longer let reporters from CNN, MS NOW and Politico into the White House. The justification was neither legal nor political, but downright liturgical: "If they're going to write fake news, I feel that's my obligation to not let them back into a very special house." The White House, he added,…

ugar