A GPT-5.6 biztonsági tesztjei riasztó eredményt hoztak
A mesterséges intelligenciáról szóló hírek többsége arról szól, hogy az új modellek egyre okosabbak, gyorsabbak és egyre több feladatot képesek elvégezni - ez önmagában jó hír. Van azonban egy kevésbé látványos oldala is a fejlődésnek: minél ügyesebb egy mesterséges intelligencia, annál nagyobb segítséget jelenthet azoknak is, akik nem éppen jó célokra akarják használni, és pontosan emiatt keltett komoly visszhangot az Egyesült Királyság AI Biztonsági Intézetének (AISI) legfrissebb jelentése.
A „jailbreak” szó hallatán sokaknak még mindig a régi iPhone-ok jutnak eszébe, amikor a felhasználók feltörték a készüléket, hogy olyan funkciókat is használhassanak, amelyeket a gyártó eredetileg letiltott. A mesterséges intelligenciánál nagyjából ugyanez történik. A fejlesztők különféle biztonsági korlátokat építenek a modellekbe, hogy azok ne adjanak útmutatást például csalásokhoz, kártékony programok készítéséhez vagy kibertámadások végrehajtásához. Egy jól sikerült jailbreak viszont képes ezeket a korlátokat megkerülni, vagyis rávenni a modellt arra, hogy olyan válaszokat is adjon, amelyeket normál esetben megtagadna. Egyszerűbben fogalmazva: olyan, mintha egy bank páncéltermének ajtaján lenne egy héttonnás acélajtó, de valaki közben nyitva hagyná a hátsó kiskaput.
Az AISI még a GPT-5.6 Sol nyilvános megjelenése előtt vizsgálta a modellt, és úgynevezett univerzális jailbreakeket talált. Ezek azért különösen veszélyesek, mert nem egyetlen speciális helyzetben működnek, hanem sokféle környezetben képesek megkerülni a biztonsági korlátozásokat. A brit szakemberek szerint ezekkel a módszerekkel a modell képes volt hosszabb, összetettebb kiberműveletek támogatására is. Ide tartozott például számítógépes rendszerek sebezhetőségeinek felderítése, valamint olyan információk előállítása, amelyek segíthetik egy támadás megtervezését. A tesztek szerint a GPT-5.6 Sol ezen a területen jelentős előrelépést mutatott az előző generációhoz képest. Míg a GPT-5.5 tíz hosszú távú kibertámadási kihívásból mindössze kettőt tudott sikeresen teljesíteni, addig az új modell tízből hetet. Az AISI arra a következtetésre jutott, hogy a modell akár kisebb, gyengébben védett vállalati hálózatok megtámadásában is segítséget nyújthat.
A jelentés nem azt állítja, hogy a GPT-5.6 magától feltöri a világ bankjait vagy átveszi az irányítást az internet felett – ezt legfeljebb Hollywoodban szokták kétórás filmekben megoldani. A probléma inkább az, hogy egy rosszindulatú felhasználó munkáját jelentősen megkönnyítheti, ugyanis, ha valaki eddig hosszú órák vagy napok alatt gyűjtötte össze egy támadáshoz szükséges információkat, egy ilyen modell ezt a folyamatot jelentősen felgyorsíthatja.
Az OpenAI szerint még a nyilvános bevezetés előtt reprodukálták és kijavították az AISI által jelzett konkrét jailbreak-módszereket, a vállalat azt is közölte, hogy több mint 700 000 A100e GPU-órát fordított automatizált biztonsági tesztelésre, vagyis arra, hogy a lehető legtöbb hasonló kiskaput megtalálják és bezárják még az éles indulás előtt. Ugyanakkor az OpenAI azt is elismerte, hogy valószínűleg a jövőben is megjelennek új jailbreak-technológiák, ezért a rendszer folyamatos, automatizált biztonsági tesztelés alatt marad.
Felhasznált forrás: Nile1
Tetszett a cikk?
Támogassa a munkánkat egy kis adománnyal
Biztonságos fizetés Stripe-on keresztül • Min. 2 EUR
Gesta-ajánló:

Szele Tamás: Két szélhámos egy tutajon
Olyan Putyin és Kim Dzsongun, mint a király és a herceg a Huckleberry Finnből: két szélhámos egy tutajon, akik egymást főnemesnek titulálják, és azt várják, hogy mások is higgyenek nekik.

A PSD–AUR-RMDSZ jogállambontásának ára: 770 millió eurót bukunk el
A Fritz-módosítás történetét az Ugar olvasóinak aligha kell elölről elmesélnünk, az elmúlt hetekben ugyanis meglehetősen közelről követtük, hogyan sikerült egy eredetileg az integritási rendszer megerősítésére szánt, ráadásul PNRR-mérföldkőnek számító törvényből előbb politikai fegyvert, majd alkotmányjogi abszurditást gyártani. Most viszont a történet eljutott oda, ahol már nem lehet bukaresti…

Trump új barátja: az egykori al-Kaida-vezér
A Közel-Keleten időnként olyan sebességgel fordul meg a történelem, hogy az embernek ellenőriznie kell, valóban ugyanazokról a szereplőkről olvas-e. Ahmed al-Sharaa néhány évvel ezelőtt még Abu Mohammad al-Golani néven volt ismertebb, az al-Kaida szíriai ágának, az al-Nuszra Frontnak a parancsnokaként harcolt, az Egyesült Államok terroristaként tartotta nyilván, és egy időben tízmillió dolláros…

Nagyvárad: kilopták a magyar nyelvet a háromnyelvű utcatáblákból
Nagyváradon végre megjelentek a háromnyelvű utcatáblák, aminek első hallásra akár örülhetnénk is, hiszen egy olyan városban, amelynek története, arculata és utcanevei évszázadokon át több nyelven éltek egyszerre, aligha volna forradalmi gondolat, hogy ebből valami a köztereken is látszódjon. Csakhogy a történetben van egy apró váradi csavar: ezek a táblák nem egészen azok, amelyeket a polgárok…

Kaukázus, a ketyegő bomba
Az Észak-Kaukázusról a térséget kevésbé ismerő nézőnek valószínűleg néhány egymástól elszakadt kép jut eszébe: Habib Nurmagomedov, a dagesztáni veretlen UFC-bajnok; Ramzan Kadirov, a fegyveresei között pózoló csecsen vezető, aki rendszeresen hangoztatja Vlagyimir Putyin iránti hűségét; a beszláni iskolai túszdráma; esetleg a bostoni maraton elleni merénylet, amelyet egy csecsen családból származó…