Az Anthropic legrégebbi, alapító munkatársai közül többen konkrét vészforgatókönyveket dolgoznak ki arra az esetre, ha a mesterséges intelligencia fejlődése kicsúszna az emberi ellenőrzés alól (a The Wall Street Journal tényfeltáró riportja szerint). Az érintett kutatók az elmúlt hetekben távoli, elszigetelt amerikai területeken terveznek földterületeket vásárolni, ahová egy rendszerszintű technológiai katasztrófa vagy kontrollvesztés esetén visszavonulhatnának.
A manhattani forgatókönyv és a sivatagi kutatóbázis gondolata
A veszélyek elől való elzárkózás nem új keletű a vállalat belső köreiben. Korábbi munkatársak beszámolói alapján az Anthropic legkorábbi céges vacsoráin rendszeresen felmerült egy Manhattan-tervhez hasonló forgatókönyv. Eszerint a mérnököknek egy sivatagi, kormányzati felügyelet alatt álló bázisra kellene költözniük, hogy egy külső hálózatoktól elzárt, elektromágnesesen árnyékolt Faraday-kalitkában folytassák az élvonalbeli modellek tanítását.
A felvetés célja a kódok és a súlyok illetéktelen kiszivárgásának megakadályozása volt arra az esetre, ha a globális geopolitikai helyzet vagy a modellek önálló képességei átlépnének egy kritikus határt. A gondolatot a szeptemberben lemondott korábbi Anthropic-kutató, Jacob Coxon is felidézte nyilvános állásfoglalásában. Coxon megfogalmazása szerint abszurd helyzet, hogy a globális kockázatokat hordozó technológia fejlesztése néhány San Franciscó-i mérnök hordozható számítógépén zajlik, ahelyett, hogy egy sivatagi katonai bunkerben folyna, mint a Manhattan-terv idején.

Az effektív altruizmus gyökerei és a doomer-szubkultúra
A félelmek gyökere az Anthropic alapító gárdájának szellemi hátterében keresendő. Dario Amodei vezérigazgató, Daniela Amodei elnök és az OpenAI-ból 2021-ben kivált alapító mag szoros kapcsolatot ápol az effektív altruizmus mozgalmával. A Bay Area technológiai közege évtizedek óta vizsgálja az emberi civilizációt fenyegető egzisztenciális veszélyeket.
Mielőtt a nagy nyelvi modellek kerültek volna a viták fókuszába, a közösség aszteroida-becsapódásokkal, szupervulkán-kitörésekkel és mesterséges világjárványokkal számolt. Eliezer Yudkowsky kutatásai nyomán az autonóm kódok elszabadulása a legsürgetőbb fenyegetéssé lépett elő. Az Anthropic belső kultúrájában a mai napig természetes téma a civilizációs összeomlás becsült valószínűsége, amit a csapat több tagja kétszámjegyű százalékra tesz.
Kettős valóság: tőkebevonás és magánbunkerek az élvonalban
A telekvásárlások rávilágítanak az élvonalbeli mesterséges intelligencia fejlesztésének legnagyobb belső feszültségére. Ugyanaz a mérnökcsapat készíti fel a vállalatot a tőzsdei bevezetésre és fejleszti a Claude modelleket (például a Claude Opus 5.5-öt), amely privát vészforgatókönyveket készít a technológia elszabadulása ellen.
A vállalat korábban létrehozott egy független felügyelő testületet (Long-Term Benefit Trust), amely elméletileg jogosult meneszteni az igazgatótanácsot vagy leállítani a modellek tanítását, ha a biztonsági kockázatok meghaladják az elfogadható szintet. A kutatók egyéni szintű óvintézkedései – a távoli telkek, aggregátorok és tartalékkészletek felhalmozása – azt jelzik, hogy a szakemberek a jogi és vállalati fékekben sem bíznak feltétel nélkül.
Miközben az Anthropic a globális versenyben tízmilliárd dolláros befektetésekkel halad előre a tőzsdei bevezetés előkészítésével, a legbelső körökben a túlélési esélyek kalkulálása a mindennapi mérnöki munka része maradt.