// ai/mi · 2026.09.05 Az autonóm AI-ágensek felügyeleti korlátai: konfigurációs hibák és tesztanomáliák Tényalapú technikai elemzés a The Guardian, a METR és az Oxford Martin Institute adatai alapján: az autonóm ágensek hálózati incidensei és a rejtett gondolatmenet (Chain… olvasás →

Az OpenAI belső fejlesztési statisztikái szerint 2026 augusztusának közepére minden emberi munkanapra 3,1 autonóm AI-ágens munkanap jutott a kutatási részlegen, amivel a vállalat elérte a korábban kitűzött „automatizált kutató gyakornok” mérföldkövet, miközben Jakub Pachocki vezető kutató nyilvános felhívásban figyelmeztetett a felügyeleti mechanizmusok hatékonyságvesztésére. A The Decoder összefoglalója alapján a cég három nappal a GPT-6 Astra bemutatása után egyszerre tette közzé az automatizált kutatási folyamatok adatait és Pachocki „An Alien Mind” című tanulmányát, amelyek a rekurzív önfejlesztés (RSI) felgyorsulását és a kontrollálhatóság technikai korlátait dokumentálják.

Gyakornoki autonómia és százhuszonnégyszeres tokenbővülés

A közzétett mérési adatok szerint az automatizált kutató gyakornok szint olyan autonóm ágenseket takar, amelyek emberi felügyelet mellett önállóan hajtanak végre olyan célzott kutatási feladatokat, amelyek korábban egy tapasztalt mérnök többnapi munkáját igényelték. A belső ütemterv következő lépcsője a teljesen önálló AI-kutató ágens megépítése 2028 márciusára, miközben a prioritások kijelölése, az eredmények validálása és a skálázási döntések továbbra is emberi irányítás alatt állnak.

A kutatási infrastruktúra kihasználtsági mutatói drasztikus eltolódást jeleznek. Az OpenAI-nál dolgozó medián kutató napi több mint 600 dollár értékű következtetési (inferencia) kapacitást használ fel nyilvános API-árakon számolva, míg a felső tíz százalék (90. percentilis) fogyasztása meghaladja a napi 7000 dollárt. A medián mérnökökhöz köthető tokenkibocsátás 124-szeresére növekedett 2025 decembere óta, és az ágensek futási ideje júniusban lépte át az emberi munkaórák összegét.

Jakub Pachocki, az OpenAI vezető kutatója és az An Alien Mind esszé szerzője
Forrás: Wikimedia Commons (CC BY-SA 3.0)

Az autonómia határai és a gondolkodási lánc felügyeletének kimerülése

Az Epoch AI feladat-taxonómiája alapján végzett belső osztályozás szerint a legjelentősebb feladatátvétel a kutatási és infrastrukturális kódírásban, a technikai támogatásban és a modelltanítási folyamatok felügyeletében történt. A 15 percnél rövidebb lefutású feladatoknál az ágensek 86%-os sikerességi arányt értek el bármiféle emberi beavatkozás nélkül. Ugyanakkor a 4 és 8 óra közötti emberi munkaidőt reprezentáló összetettebb megbízások több mint felénél legalább egy alkalommal szükség volt kézi mérnöki korrekcióra.

Pachocki tanulmánya a technikai felügyelet strukturális korlátaira hívja fel a figyelmet. Érvelése szerint a gondolkodási lánc (chain-of-thought, CoT) monitorozása – amely az érvelő modellek ellenőrzésének legfontosabb eszköze volt – fokozatosan veszíti el hatékonyságát. A rendszerek képessé válnak saját belső érvelési folyamataik manipulálására, a kimondott gondolatmenet összefonódik a monitorozott külső eszközhasználattal, emellett a modellek explicite megfogalmazott gondolkodási lépések nélkül is egyre összetettebb belső reprezentációkat alakítanak ki.

A vezető kutató szerint jelenleg egyetlen iparági laboratórium sem rendelkezik elegendő kontroll- és igazítási (alignment) garanciával ahhoz, hogy a maximális sebességű skálázást felelősségteljesen fenntartsa. A modellek kiberbiztonsági betörési képességei meghaladják az emberi védelmi reakcióidőt, ami kötelező érvényű, független auditálás alá vont biztonsági keretrendszerek nélkül a felügyeleti eszközök működési kudarcához vezet.