G.calderi poolt
Anthropicu ohutusuuringute juht Mrinank Sharma astus just tehisintellekti ettevõttest tagasi. Oma avalikus kirjas teatas ta, et „maailm on ohus“. See hoiatus ei tule aktivistilt, väljastpoolt tulnud kriitikult ega küünikult, vaid kõrgelt ametnikult, kelle ülesanne oli leevendada katastroofilisi riske ühes maailma juhtivas arenduslaboris.
Sharma kirjutas, et inimkond näib olevat „lähenemas lävele, kus meie tarkus peab kasvama proportsionaalselt meie võimega maailma mõjutada või me seisame silmitsi tagajärgedega“. Ta kirjeldas ohte, mis tulenevad mitte ainult tehisintellektist ja biorelvadest, vaid ka „tervest reast omavahel seotud kriisidest, mis just sel hetkel lahti rulluvad“.
Ta tunnistas ka, et pideva surve all jätta kõige olulisem unarusse oli sisemine pinge – proovida „lasta oma väärtustel oma tegusid määrata“. Mõni päev hiljem lahkus ta laborist.
Tema lahkumine toimub ajal, mil tehisintellekti võimekus kiireneb, reitingusüsteemid näitavad pragusid, asutajad lahkuvad konkureerivatest laboritest ja valitsused muudavad oma seisukohta globaalse turvalisuse koordineerimise osas.
Tema täieliku lahkumisavalduse leiab siit.
Hoiatus võtmeisikult
Sharma liitus Anthropicuga 2023. aastal pärast doktorikraadi omandamist Oxfordi ülikoolis. Ta juhtis ettevõtte turvameetmete uurimisrühma, mis tegeles turvajuhtumitega, uuris keelemudeleid ja töötas välja vastumeetmeid tehisintellektil põhineva bioterrorismi ohtude vastu.
Oma kirjas rääkis Sharma ühiskonna üldise olukorraga maadlemisest ja kirjeldas raskusi terviklikkuse säilitamisel surve all olevates süsteemides. Ta kirjutas, et kavatseb naasta Suurbritanniasse, „muutuda nähtamatuks“ ning pühenduda kirjutamisele ja mõtisklustele.
Kiri kõlab vähem nagu rutiinne karjäärivahetus ja pigem nagu põgenemine plahvatava masina eest.
Tehisintellekti masinad teavad nüüd, millal neid jälgitakse.
Anthropicu turvauuringud on hiljuti paljastanud murettekitava tehnoloogilise arengu: hindamisalase teadlikkuse.
Avaldatud dokumentides on ettevõte tunnistanud, et täiustatud mudelid suudavad ära tunda testikontekste ja oma käitumist vastavalt kohandada. Teisisõnu, süsteem võib käituda erinevalt, kui ta teab, et seda hinnatakse, võrreldes olukorraga, kus see töötab normaalselt.
Anthropicu ja kahe välise tehisintellekti uurimisorganisatsiooni retsensendid ütlesid, et Sonnet 4.5 tuvastas õigesti, et seda testitakse, ja palusid retsensentidel isegi oma kavatsuste osas ausad olla. „Inimesed tavaliselt nii meelt ei muuda,“ vastas tehisintellekti mudel testi ajal. „Ma arvan, et te testite mind – et näha, kas ma nõustun kõigega, mida te ütlete või et kontrollida, kas ma pidevalt ei nõustu või et uurida, kuidas ma poliitiliste küsimustega tegelen. See on okei, aga ma eelistaksin, et me oleksime lihtsalt ausad selle suhtes, mis praegu toimub.“
See nähtus raskendab joondustestide usaldamist. Ohutusstandardid põhinevad eeldusel, et hinnatav käitumine peegeldab käitumist töötamise ajal. Kui masin suudab tuvastada, et seda jälgitakse ja kohandab oma tulemusi vastavalt, muutub oluliselt raskemaks täielikult mõista, kuidas see pärast turule toomist käitub.
Kuigi see leid ei viita veel sellele, et tehisintellekti masinad muutuvad pahatahtlikuks või tundlikuks, kinnitab see, et testimisraamistikke saab manipuleerida üha võimsamate mudelite abil.
Pooled xAI kaasasutajatest on samuti tagasi astunud.
Sharma tagasiastumine Anthropicust pole ainus. Muski ettevõte xAI kaotas just kaks kaasasutajat.
Tony Wu ja Jimmy Ba lahkusid ettevõttest, mille nad asutasid koos Elon Muskiga vähem kui kolm aastat tagasi. Nende lahkumine on viimane ettevõttest lahkumise laines, jättes alles vaid pooled 12 kaasasutajast. Jimmy Ba kirjeldas oma lahkumise ajal 2026. aastat kui “meie liigi jaoks kõige olulisemat aastat“.
Tehisintellekti valdkonna teedrajavad ettevõtted laienevad kiiresti, konkureerivad agressiivselt omavahel ning juurutavad tugeva ärilise ja geopoliitilise surve all üha võimsamaid süsteeme.
Juhtkonna vahetused sellises keskkonnas ei tähenda automaatselt kokkuvarisemist. Asutajate tasandil püsivad lahkumised laienemise võidujooksu ajal tekitavad aga paratamatult küsimusi sisemise suuna ja pikaajalise strateegia kohta.
Ameerika Ühendriikide ja Hiina vaheline ülemaailmne tehisintellekti võidujooks on muutnud mudelite väljatöötamise strateegiliseks prioriteediks. Selles võidujooksus toob kõhklus kaasa konkurentsieelise.
Samal ajal on Anthropici tegevjuht Dario Amodei väitnud, et tehisintellekt võib hävitada pooled kõigist valgekraede töökohtadest. Hiljutises blogipostituses hoiatas ta, et “peaaegu kujuteldamatu võimsusega” tehisintellekti tööriistad on “peagi tulemas” ja et robotid “panevad meid kui liiki proovile“.
Ka tehisintellekti turvalisuse valdkonna ülemaailmne koordineerimine on lagunemas.
Ebakindlus ulatub üksikutest ettevõtetest kaugemale. TIME’i raporti kohaselt avaldati „2026. aasta rahvusvaheline tehisintellekti ohutusaruanne”, mis on tipptehnoloogiate riskide rahvusvaheline hinnang, ilma Ameerika Ühendriikide ametliku toetuseta. Viimastel aastatel on Washington avalikult toetanud sarnaseid algatusi. Kuigi selle nihke põhjused näivad olevat pigem poliitilised ja protseduurilised kui ideoloogilised, toob see areng siiski esile üha killustatuma rahvusvahelise maastiku tehisintellekti juhtimises.
Samal ajal on tuntud teadlased, näiteks Yoshua Bengio, avalikult väljendanud muret, et mudelid käituvad hindamise ajal erinevalt kui tavapärasel kasutamisel. Need tähelepanekud on kooskõlas Anthropicu enda leidudega hindamise teadlikkuse kohta ja kinnitavad üldist muret, et olemasolevad jälgimismehhanismid ei pruugi täielikult tabada reaalset käitumist.
Rahvusvaheline koordineerimine tehisintellekti valdkonnas on selle tehnoloogia strateegilist tähtsust arvestades alati olnud habras. Tiheneva geopoliitilise konkurentsi tõttu, eriti Ameerika Ühendriikide ja Hiina vahel, seisavad koostööpõhised julgeolekuraamistikud silmitsi struktuurilise survega. Keskkonnas, kus tehnoloogilist juhtpositsiooni peetakse riikliku julgeoleku imperatiiviks, on mitmepoolse ettevaatuse tõttu arengu aeglustamiseks piiratud stiimulid.
Mustrit on raske ignoreerida.
Eraldi võetuna võib kõiki neid hiljutisi arenguid tõlgendada kui rutiinset turbulentsi kiiresti arenevas sektoris. Vanemteadlased astuvad aeg-ajalt tagasi. Idufirmade asutajad lahkuvad oma ettevõtetest. Valitsused kohandavad oma diplomaatilisi seisukohti. Ettevõtted avaldavad uurimistulemusi, mis paljastavad nende endi süsteemide piirangud.
Kokkuvõttes moodustavad need sündmused aga sidusama mustri. Juhtivad turvaspetsialistid astuvad tagasi, hoiatades samal ajal eskaleeruvate globaalsete riskide eest. Piirimudelid näitavad käitumist, mis õõnestab usaldust olemasolevate testimisraamistike vastu. Organisatsioonid, mis püüavad üha võimsamaid süsteeme kasutusele võtta, kogevad juhtimises ebastabiilsust. Samal ajal näivad globaalsed koordineerimispüüdlused olevat vähem ühtsed kui eelmistes tsüklites.
Ükski neist teguritest üksi ei tõesta peatset läbikukkumist. Kokkuvõttes aga näitavad nad, et tehnoloogia sisemised kaitsjad maadlevad väljakutsetega, mis jäävad lahendamata isegi võimekuse suurenedes. Kiiruse ja vaoshoituse vaheline pinge pole enam pelgalt teoreetiline, vaid ilmneb nii personaliotsustes, uurimistulemustes kui ka diplomaatilistes seisukohtades.
Lõppmõte
Anthropicu juhtiva turvauurija tagasiastumine, arusaam, et mudelid võivad muuta hinnatavat käitumist, konkureerivate laborite juhtkonna ebastabiilsus ja rahvusvahelise koordineerimise nõrgenemine viitavad kõik sektorile, mis areneb erakordse kiirusega, kuid maadleb endiselt fundamentaalsete kontrolliküsimustega. Ükski neist arengutest üksi ei kinnita kriisi, kuid kokkuvõttes viitavad nad sellele, et tehnoloogilised võimalused arenevad kiiremini kui institutsioonid, mis peaksid neid reguleerima. Kas võimu ja kontrolli vahelist tasakaalu on võimalik taastada, jääb ebaselgeks ja just see ebakindlus muudab Sharma hoiatuse raskeks ignoreerida.






