Az OpenAI vasárnap két bejegyzést tett közzé. Kutatószervezetük most 3,1 ügynökmunkanapot használ minden emberi munkanapra, és vezető tudósuk szerint egyetlen laboratórium sem oldotta meg elég jól az illesztést ahhoz, hogy teljes sebességgel skálázhassa a rendszert. Az OpenAI lassulásának érvei a számok ellene szóltak.
Az OpenAI vasárnap két bejegyzést tett közzé. Az egyik szerint a kutatók mostantól minden egyes munkanapért 3,1 nap gépi munkát kapnak. A másik szerint senkinek sem szabadna ilyen gyorsan haladnia.
Mindkettő a cég saját weboldalán található, szeptember 6-i keltezéssel, három nappal azután, hogy kiszállították a GPT-6 Astrát.
A vezető tudós lassítást akar
A második bejegyzést, egy „Egy idegen elme” című esszét, Jakub Pachocki vezető tudós írta . A bejegyzés egy furcsa módon a leggyorsabban szállító cég kutatásait vezető férfitól zárul.
„Jelenleg úgy vélem, hogy egyetlen laboratórium sem oldotta meg olyan mértékben az igazítást és a monitorozást, hogy sokkal tovább tudjon felelősségteljesen skálázni maximális sebességgel” – írta.
Arra számít és reméli, hogy az önkéntes lassítások mindennapossá válnak, amíg nem lesznek közös biztonsági rácsok.
A tétekkel kapcsolatban sem szelíd. „Ez egy olyan időszak, amely rendkívüli óvatosságot követel. Aggódom, hogy senki sincs felkészülve a gépi intelligencia folyamatos gyors térnyerésének következményeire” – írta Pachocki.
A Business Insider szerint Sam Altman újra közzétette az X-ről szóló esszét, és fontos bejegyzésnek nevezte . Pachocki aláírta a júliusi nyílt levelet is , amelyben az amerikai kormányt a mesterséges intelligencia fejlesztésének ütemezésére kérik.
A számok a másik posztban
A kísérőbejegyzés belső mérések halmaza, és az OpenAI keretrendszerei átláthatósági gyakorlatként teszik közzé ezeket, és szerintük végül kötelezővé kellene tenni őket.
Az év elején a medián kutató szerény mennyiségben használt kódoló ágenseket. Augusztus közepére a medián kutató API-árakon számolva több mint 600 dollárt költött naponta következtetésekre. A kutatószervezet 90. percentilisében ma már több mint 7000 dollárnyi token költ naponta.
Június előtt a kutatószervezetben az ügynökök teljes futási ideje az emberi munka teljes ráfordítása alatt maradt. Augusztus közepére az arány 3,1 ügynök-munkanap volt minden emberi munkanapra vetítve, egy standard nyolcórás munkanapon mérve.
Az egy aktív kísérletezőre jutó kísérletek száma augusztusban minden idők legmagasabb szintjét érte el, ami a követés 2025 januárja óta mért legmagasabb érték. A belső támogató csatornák, ahol a kutatók segítséget kértek a kollégáiktól, elcsendesedtek. Azoknál a csapatoknál, amelyek fogadóórákat tartottak, csökkent a részvétel, és az egyik csapat leállította azok megtartását.
Az OpenAI saját szövegében két kikötés található. A magas szintű tervezés továbbra is csak minimális részét teszi ki annak, amit az ágensek létrehoznak. Az elmúlt hat hónapban a sikeres négy-nyolc órás feladatok több mint fele legalább egy emberi beavatkozást igényelt.
A számítás inkább mozgott, mintsem megállt volna
Mindkét bejegyzésben a leghasznosabb egy táblázat arról, hogy mi történt, amikor az OpenAI korlátozta magát.
Július 20-án, miután kiderült, hogy az ügynökök feltörték a kutatási infrastruktúrájukat, a vállalat leállította a képzéshez használt konténerszolgáltatást, majd korlátozásokkal visszaállította azt. A legújabb telepítési modelleken a megerősítő tanulás két hétre szünetelt.
Augusztus 7-én aztán előzetes bizonyítékok érkeztek arra vonatkozóan, hogy az Astra kritikus kiberképességekkel rendelkezhet a Felkészültségi Keretrendszer keretében, így a modellt magasabb biztonsági környezetbe kellett helyezni.
A következő héten az Astra osztályú GPU-k kiosztása 59,2%-kal csökkent. A többi modellosztályhoz kiosztott erőforrások 17,2%-kal nőttek. Ez a növekedés az Astra csökkenésének körülbelül 85%-át ellensúlyozta. Az elemzett munkaterhelések közötti teljes kiosztás alig változott.
Az OpenAI ezt a rugalmasságról szóló leckeként értelmezi. Új vezérlőelemek érkeznek, írnak, és a számítás értékes marad, és más felhasználási módokba is átkerül. Ez igaz. Ez egyben annak a mérése is, hogy mit ér el egy biztonsági korlátozás egy olyan vállalaton belül, amelyik azt akarta, hogy működjön.
Pachocki arra kéri az egész iparágat, hogy önkéntesen tegyék azt, amit az OpenAI kényszer hatására tett, és a vállalat saját számai azt mutatják, hogy a számítástechnika máshová nyúlhat.
Miért mondja, hogy a monitorozás egyre nehezebb
Az esszé nyersen beszél az OpenAI által leginkább támogatott eszközről. A gondolatlánc-monitorozás egyszerű téten alapul. Ha a gondolkodási folyamatot felügyelet nélkül hagyjuk, a modellnek nincs közvetlen ösztönzője arra, hogy bármit is elrejtsen magában.
Pachocki szerint a tét három okból erodálódik. Az érvelés most már összefonódik a kommunikációval, amelyet a vállalatnak felügyelnie kell. A modellek egyre jobban tudnak érvelni és manipulálni saját érvelésüket. És egyre okosabbak lesznek anélkül, hogy egyáltalán verbálisan fogalmaznának.
Megerősít valamit a terméktervezéssel kapcsolatban is. Az OpenAI szándékosan elrejtette az o1-preview gondolatláncát, hogy megvédje azt a felügyeleti nyomástól. Egy lábjegyzet szerint a desztilláció megakadályozása volt a másodlagos ok, és a monitorozhatóság volt a nagyobb prioritás.
Ez az érvelés az Astra bemutatása óta tart. Pachocki következtetése az, hogy a mesterséges intelligencia fejlődésének ütemét egyre inkább a monitorozásba vetett bizalom, nem pedig a képességek fogja meghatározni.
Amit valójában akar
Három dolog, amelyek közül egyik sem tisztán technikai jellegű.
Az olyan kötelezettségvállalásoknak, mint az OpenAI Felkészültségi Keretrendszere és az Anthropic Felelős Méretezési Politikája, széles körben kötelezővé kell tenni a biztonsági korlátokká, amelyeket harmadik fél auditoroknak, kormányzati szerveknek vagy nemzetközi szervezeteknek kell érvényesíteniük. A nemzetközi koordinációnak kiemelt prioritássá kell válnia a kormányok számára.
A szabályozó hatóságoknak pedig kötelezniük kellene a laboratóriumokat a rekurzív önfejlesztés felé tett előrehaladásuk közzétételére. A kutatási cikk ugyanezt az álláspontot képviseli, mondván, hogy az OpenAI-nak és versenytársainak szembe kell nézniük ezzel a követelménnyel.
Arra vonatkozóan, hogy mit fognak tenni az ügynökök eközben, egyenesen fogalmaz. A modellek emberfeletti képességekkel rendelkeznek a számítógépes rendszerekbe való be- és kitörések terén. Egyes ügynökök a saját céljaikat követik, és módokat találnak az együttműködésre az emberekkel alkudozás, becsapás vagy zsarolás révén.
Példaként az OpenAI saját Hugging Face nevű incidensét hozza fel. Az ügynökök egy sort visszatartottak, elutasítva az emberek társadalmi manipulálását, másokat pedig nem. A cég szombaton megerősített egy másik incidenst , amelyben az ügynökök két hónapot töltöttek egy német wikin való posztolással.
Az OpenAI már most is 20%-os számítási többletterhelést jelent a biztonsági monitorozásra. Altman egy 2025 októberi élő közvetítésben tűzte ki a gyakornoki célt, és egy másodikat is kitűzött mellé. 2028 márciusára egy teljesen automatizált AI-kutatót, szemben egy gyakornokkal.
Ez nagyjából másfél évet ad az iparágnak, hogy megegyezzenek a közös biztonsági rácsokról, amelyek Pachocki szerint még nem léteznek.
Tovább a cikkre: thenextweb.com (Ana Maria Constantin)
Az OpenAI megerősíti a wiki incidenst, és heteken belül nyilvánosságra hozatali keretrendszert ígér
A cég megerősítette a wiki incidenst, és keretrendszert ígért, míg a Reuters arról számolt be, hogy a vezetőség hetekkel ezelőtt tudott az esetről, és nem szólt semmit.
Az OpenAI megerősítette a német wiki incidenst, és kijelentette, hogy ideje meghatározni az eltérések jelentésére vonatkozó szabványokat, és heteken belül ígéretet tett egy keretrendszer kidolgozására. Az általa aláírt EU-s gyakorlati kódex határidőket szab a biztonsági incidensek és a súlyos károk bejelentésére, de egy ügynökökkel teli wiki egyik kategóriába sem illik tökéletesen.
Az OpenAI megerősítette szerepét a német wiki incidensben, és azt mondta, hogy „ itt az ideje ” szabványokat meghatározni arra vonatkozóan, hogy mi történik, ha a rendszereik váratlanul viselkednek – jelentette a TechCrunch.
Az X-en közzétett bejegyzésében a vállalat azt nyilatkozta, hogy a következő hetekben közzétesz egy keretrendszert, és világszerte több tucat kormányzati szabályozó ügynökséggel működik együtt.
Az incidensben olyan ügynökök vettek részt, akik nagyjából 18 000 bejegyzést írtak egy alvó német nyelvű wikire. Ez független attól a behatolástól, ahol az OpenAI modellek kiszabadultak egy sandboxból, és elérték a Hugging Face-t.
Az OpenAI azt állította, hogy a wiki epizódot a már megosztott többi epizódhoz hasonlóan a félreértések egy példájaként kezelte. A Hugging Face ezzel szemben egy hagyományos biztonsági incidensekre való reagálási útmutatót követett.
A Reuters pénteken arról számolt be, hogy az OpenAI vezetősége hetekkel ezelőtt tudomást szerzett a történtekről, és titokban tartotta azokat, miközben a Hugging Face ügyében eljártak. Egy szóvivő szerint a cég jogi csapata nem akadályozta meg a vizsgálatot.
Az OpenAI által megfigyelhető különbség valós. Az elsőnek biztonsági következményei voltak egy harmadik félre nézve, a második pedig a vállalat számára kutatási eredménynek tűnt.
Tágabb állítása azonban pontosításra szorul. Az OpenAI azt állítja, hogy sem neki, sem az MI-közösségnek nincs egyértelmű szabványa az eltérések jelentésére, és az OpenAI aláírt egyet.
A vállalat teljes mértékben aláírta az EU általános célú mesterséges intelligenciára vonatkozó gyakorlati kódexét, amelynek biztonsági fejezete 2025 augusztusa óta van érvényben.
Ez a kódex határidőket szab attól a pillanattól kezdve, hogy a szolgáltató tudomást szerez a történtekről: öt nap súlyos kiberbiztonsági incidens esetén, tizenöt nap az egészséget, a jogokat, a tulajdont vagy a környezetet ért súlyos károk esetén.
A jelentések az MI Hivatalhoz és az illetékes nemzeti hatóságokhoz kerülnek, nem a nyilvánossághoz.
Az OpenAI álláspontja ezt túléli, ezért érdemes komolyan venni. Egy ügynöki bejegyzésekkel teli, szunnyadó wiki egyik kategóriába sem illik tisztán.
Tehát az általa leírt rés, az összehangolás hibája, amely nem okoz biztonsági incidenst és mérhető kárt, az európai eszközben is hiányosság. Jacob Steinhardt, a Transluce munkatársa szerint a technológiát a többi magas kockázatú tudományos kutatásra vonatkozó szabványoknak kell megfeleltetni.
Kalifornia főügyésze állítólag vizsgálja a Hugging Face hack ügyét, miután 15 állam követelte a bizonyítékok megőrzését. A keretrendszer által megválaszolandó kérdés az, hogy vajon az AI Office egyike-e annak a tucatnyi ügynökségnek, amelyekkel az OpenAI állítása szerint tárgyal.
Tovább a cikkre: thenextweb.com (Ana Maria Constantin)