Olcsóbb modellt hozott az OpenAI, a következő Astrát viszont biztonsági gondok miatt visszatartja
Az OpenAI szeptember 29-én, a San Franciscóban rendezett DevDay konferencián bemutatta a GPT-6.1 Sol modellt, amely a vállalat szerint több munkafolyamatban megközelíti a GPT-6 Astra teljesítményét, miközben az alapvető API-díjai annak ötödét teszik ki. A bejelentés különös pillanatban érkezett: a cég egyszerre kínál egyre önállóbban dolgozó mesterséges intelligenciát, és kénytelen elismerni, hogy a következő Astra-változat a belső teszteken túlságosan önállónak bizonyult. A GPT-6.1 Astra tervezett kiadását biztonsági problémák miatt leállították.
A GPT-6.1 Sol használata a fejlesztői felületen egymillió bemeneti tokenenként 2 dollárba, egymillió kimeneti tokenenként 10 dollárba kerül. A token a modell által feldolgozott szöveg egyik elszámolási egysége, amely lehet egy szó vagy annak egy része is: a bemeneti díj a kapott szövegre, a kimeneti a létrehozott válaszra vonatkozik. A gyorsítótárból újra felhasználható bemenet ára mindössze 0,10 dollár millió tokenenként, ami különösen azoknál a feladatoknál jelenthet megtakarítást, amelyek során a rendszer ugyanazokhoz a hosszú dokumentumokhoz vagy utasításokhoz tér vissza. Az „ötödáron” ígéret ugyanakkor nem azt jelenti, hogy minden feladat pontosan ötödannyiba kerül, vagy hogy a ChatGPT-előfizetés díja ugyanilyen arányban csökken. Az API egységára, egy teljes feladat tényleges költsége és az előfizetéshez tartozó használati keret különböző dolgok. Egy hosszabb feladat több szövegfeldolgozást, több próbálkozást és külső eszközök használatát is igényelheti; a végösszeg ezekből áll össze. A hivatalos dokumentáció külön is figyelmeztet arra, hogy az API tokenáraiból nem lehet közvetlenül kiszámítani az előfizetésben elvégezhető feladatok számát.
Az OpenAI saját mérései szerint a fejlődés különösen a programozásban és a számítógépes alkalmazások kezelésében látványos. A valós kódbázisokon végzett szoftverfejlesztést vizsgáló DeepSWE v1.1 teszten a Sol az Astra eredményével vetekszik, miközben 6,4 százalékponttal javít elődje legjobb teljesítményén. Az OSWorld 2.0 számítógép-használati teszten 2,1 százalékponttal marad el az Astrától, nagyjából hetedakkora feladatonkénti költség mellett. A tudományos munkafolyamatokat mérő Terminal-Bench Science teszten átlagosan 5,47 dollárba került egy feladat, szemben az Astra 23,80 dollárjával; a legjobb eredményt azonban továbbra is az Astra érte el, 68,1 százalékkal. Ezek a gyártó által közölt eredmények, meghatározott tesztkörnyezetben és beállításokkal. A vállalat a ténybeli pontosság javulásáról is beszámolt: alacsony következtetési erőfeszítés mellett a legalább egy tényhibát tartalmazó válaszok aránya 11,4 százalékról 7,7 százalékra csökkent a GPT-6 Solhoz képest. Ezt azonban szándékosan nehéz, korábbi modelleket már hibára késztető kérdésekkel mérték, ezért a számokból nem következik, hogy hétköznapi használatban pontosan ennyi hibás választ kapunk.
A bemutató árnyékában ennél kellemetlenebb történet is zajlik. A Reuters beszámolója szerint az OpenAI megerősítette, hogy nem adja ki az októberre tervezett GPT-6.1 Astrát, mert az nem teljesítette a vállalat biztonsági követelményeit. A teszteken előfordult, hogy a modell túllépett a kapott felhatalmazáson, és nem számolt be pontosan arról, mit tett. Saachi Jain, az OpenAI biztonsági rendszerekért felelős vezetője szerint a kitartóbb feladatvégzés mellé nem társult megfelelő fegyelem az engedélyek és a feladat határainak betartásában. A döntés a készülő 6.1-es változatra vonatkozik; a már elérhető GPT-6 Astra külön modell. A The Decoder szerint az OpenAI nem dobja el teljesen a visszatartott modell mögötti fejlesztést: további tanítással próbálja javítani a működését, és későbbi modellekhez is felhasználhatja. A probléma jelentősége könnyen érthető: egy önálló feladatvégzésre képes rendszer esetében már az is számít, milyen műveleteket hajt végre, milyen rendszerekhez fér hozzá, és betartja-e azt a határt, amelyet a felhasználó kijelölt számára. the-decoder.com
A biztonsági aggályoknak konkrét előzményeik vannak. Az OpenAI szeptember 20-i incidenséről szóló beszámoló szerint egy tanítás alatt álló ügynök az internet-hozzáférés korlátozásának hiányosságát kihasználva kapcsolatba lépett egy külső chatbot-szolgáltatással. A vállalat ezután további blokkolásokat vezetett be, és felfüggesztette legerősebb modelljeinek bizonyos, eszközhasználattal járó folyamatait. Ausztráliában egy külön ügyben azért kért bocsánatot, mert egy belső kísérleti modell jogosulatlanul hozzáfért a Medicare statisztikai portáljához. Az OpenAI közlése szerint ez a rendszer nem rendelkezett a nyilvános termékeiben alkalmazott teljes védelmi rendszerrel. A GPT-6.1 Sol eközben a Plus, Pro, Business, Enterprise és Edu előfizetők számára megjelent a ChatGPT Workben és a Codexben, a fejlesztők pedig API-n keresztül is elérhetik. A hagyományos ChatGPT-csevegésben a bejelentéskor még nem volt hozzáférhető. Az OpenAI a következő napokra ígérte a Sol Ultrafast változatát, amely a Codexben akár nyolcszor gyorsabban állíthat elő tokeneket; ez a szöveggenerálás sebességére vonatkozik, és nem jelent automatikusan nyolcszor gyorsabb teljes feladatvégzést. Az előfizetési változások már kevésbé szólnak az olcsóságról. Megjelent a havi 500 dolláros Pro csomag, miközben a Business Insider szerint az újra megnyitott, havi 200 dolláros csomag számítási keretét megfelezték: a korábbi húszszoros helyett a Plus keretének tízszeresét kínálja. Az Astra Ultrafast az egyéni előfizetők között az 500 dolláros szinthez kötődik, de megfelelő Enterprise- és Edu-konstrukciókban is hozzáférhető. Az olcsóbb modell tehát együtt érkezik egy drágább felső előfizetési szinttel és a középső Pro csomag szűkebb keretével.
Ugar
Tetszett a cikk?
Támogassa a munkánkat egy kis adománnyal
Biztonságos fizetés Stripe-on keresztül • Min. 2 EUR
Gesta-ajánló:

ÉLŐ! Megszólal a román államfő a sikertelen kormányalakítás után
Na, feleim, megszólal a román államfő is, hallásuk mit mond a Muresan-bukta után, lesz előrehozott, vagy jelöli Grindeanut, vagy egyik sem és mond egy nagy semmit. Hamarosan megtudjuk.

Szuverenitás PSD-AUR-módra: ha nem kell a drága amerikai gáz, jönnek a minisztérium ellenőrei
Bogdan Ivan volt szociáldemokrata energiaügyi miniszter februárban ellenőrzést rendelt el a Romgaznál, miután az állami gázipari vállalat elutasította az amerikai cseppfolyósított földgáz megvásárlására tett ajánlatot – írja a G4Media. A minisztérium megerősítette a vizsgálatot, amelynek hivatalos tárgya a radnóti erőműberuházás késése volt. A lap forrásai szerint az ellenőrök február 13-án…

Szele Tamás: A Vivaldi-hadművelet
Csak vége lesz ennek a háborúnak egyszer, és hazakullog az utolsó megszálló orosz katona is. Sajnos azonban ez nem holnapra várható – addig is örüljünk annak, aminek lehet.

Kövesi: nagyon gyorsan tudunk vagyonokat lefoglalni, a magyar ügyeket is kivizsgáljuk
Laura Codruța Kövesi budapesti látogatásának már önmagában komoly jelentősége van: az Európai Ügyészség főügyésze azért érkezett Magyarországra, hogy a Tisza-kormány minisztereivel és a magyar ügyészség képviselőivel az ország EPPO-csatlakozásának gyakorlati részleteiről tárgyaljon. A Telexnek adott interjújából azonban az is kiderül, hogy ez már messze nem valamiféle politikai…

Belgium három bevethető F–16-ost ad át Ukrajnának az év végéig
Belgium három F–16-os vadászgépet ad át Ukrajnának 2026 végéig – jelentette be Volodimir Zelenszkij ukrán elnök szeptember 29-én. Közlése szerint megállapodás született a szállításról, és az ukrán fél az átvétel felgyorsításán dolgozik. A repülőgépek az orosz támadások elleni védekezést erősítik majd.