in

Anthropicu teadlase sünge hoiatus: tehisaru võib kümne aastaga inimkonnale lõpu teha  (126)

Anthropicu teadlane Evan Hubinger peab enam kui kümneprotsendiliseks võimalust, et tehisaru hävitab järgmise kümnendi jooksul kogu inimkonna, kirjutab BBC.

Ettevõttes tehisaru ohutust uuriv Hubinger kirjutas sotsiaalmeediaplatvormil X, et praeguste mudelitega seotud risk on veel väike. Ta kardab siiski, et tehnoloogia võib peagi areneda superintellektiks, mis suudab ennast ise täiustada.

„Me tõesti usume siiralt, et tehisaru võib tappa kõik inimesed! Minu isiklik hinnang on, et selle tõenäosus on järgmise kümnendi jooksul üle kümne protsendi,“ kirjutas Hubinger.

Ta ei selgitanud, kuidas võiksid tulevased tehisarusüsteemid inimkonna hävitada.

Hubinger avaldas hinnangu vastuseks tehisaru-uurija Jacob Coxoni postitusele. Varem OpenAIs töötanud Coxon lahkus äsja Anthropicust, sest peab mõlema ettevõtte tegevust vastutustundetuks. „Kumbki ettevõte ei tegutse vastutustundlikult,“ kirjutas Coxon.

„Neist saavad peagi inimesest võimekamad süsteemid, mis suudavad häkkida ükskõik mida, teha igas valdkonnas üleöö revolutsiooni ning omandada tegelikku võimu ja ressursse.“

Kahtlus börsieelses turunduses

ÜROd tehisaru küsimustes nõustav arvutiteadlane Wendy Hall ütles BBC-le, et Hubingeri ja Coxoni postitused šokeerisid teda. Hall ei välistanud, et osa hoiatustest võib olla suhtekorraldus või turundus, sest Anthropic ja OpenAI valmistuvad pikisilmi oodatud börsidebüütideks.

„Miks peaks keegi tahtma midagi sellist öelda? Ma paluksin investoritel tungivalt sellesse ettevõttesse mitte investeerida, kui niisugune on nende väärtussüsteem,“ ütles Hall BBC Radio 4 saates „World at One“.

Coxoni lahkumise järel pöördus Briti rahandusministeeriumi endine peasekretär ja Keir Starmeri endine peasekretär Darren Jones avaliku kirjaga peaminister Andy Burnhami poole. Ta kutsus üles sõlmima tehisaru ohutuks arendamiseks uut rahvusvahelist lepet.

„Valitsused peavad kokku tulema ja arutama, milline peaks välja nägema superintellekti arendamist käsitlev lepe,“ ütles Jones BBC-le. „Kui valitsused ei võta neid hoiatusi piisavalt tõsiselt ega asu tegutsema, võib arendustempo tähendada, et probleemid tekivad enne, kui oleme jõudnud üldse hinnata, kas see on meile probleem.“

Uus mudel jäi kontrollimata

Financial Times kirjutas, et Anthropic ei andnud oma uusimat mudelit enne selle avaldamist Ühendkuningriigi tehisaru turvalisuse instituudile ehk AISI-le kontrollimiseks. AISI on üks maailma juhtivaid tehisaruriske hindavaid asutusi.

Anthropic ei kommenteerinud töötajate postitusi ega AISI-ga tekkinud olukorda.

Briti valitsuskabineti esindaja ei vastanud küsimusele, kas Anthropicu uus mudel jäeti instituudile tõepoolest esitamata. Ta märkis üksnes, et AISI jätkab mudelite turvalisemaks muutmiseks tihedat koostööd ettevõtetega, sealhulgas Anthropicuga.

Ohjeldamiseks pole plaani

Hubingeri postitust on vaadatud üle kümne miljoni korra. Ta tunnistas selles, et Anthropic pole leidnud lahendust, kuidas tagada inimesest võimekama tehisaru vastavus inimeste eesmärkidele ja väärtustele.

„Usun, et Anthropic annab endast parima, ent meil ei ole veel plaani superintellekti joondamise probleemi lahendamiseks ega ole ka selge, et liigume selle poole,“ kirjutas Hubinger.

Tehisaru joondamise eesmärk on viia süsteemide käitumine kooskõlla inimeste väärtuste ja eetiliste põhimõtetega. Nii püütakse tagada, et tehisaru tegutseks inimeste soovitud viisil.

Mitme valdkonna juhtiva teadlase hinnangul pole senised katsed olnud piisavad. Kahtlusi on süvendanud juhtumid, kus iseseisvalt tegutseda saanud tehisaruagendid on korraldanud küberrünnakuid. OpenAI, Anthropic ja Meta on kõik avalikustanud nende tööriistadega seotud ründejuhtumeid.

Anthropic muutus hinnangus ebakindlamaks

Anthropic hindas augustis avaldatud ohutusraportis väikeseks riski, et ettevõtte mudelid kalduvad kõrvale mõne hüpoteetilise võimsa organisatsiooni eesmärkidest ning hakkavad selle süsteeme ära kasutama või muutma.

Ettevõte pidas samuti väikeseks võimalust, et väga võimekas tehisaru suudab automatiseeritult teadus- ja arendustööd teha ning põhjustab omal algatusel katastroofilist kahju.

Anthropic tunnistas samas, et on selles hinnangus varasemast vähem kindel.

„Näeme võimaliku kiirenemise esimesi märke,“ seisab raportis.

Nõutakse arendustempo aeglustamist

Tehisaruvaldkonna juhtfiguurid on tehnoloogia ohutusriskide eest hoiatanud aastaid. Juba 2023. aastal juhtisid ohule tähelepanu OpenAI, Google DeepMindi ja Anthropicu juhid.

Viimastel nädalatel on hoiatused muutunud märksa teravamaks. OpenAI peateadlane Jakub Pachocki kutsus septembri alguses üles rakendama tehisaru arendamisel „äärmist ettevaatust“. Ta leidis, et inimeste kontrolli säilitamiseks võib vaja minna ulatuslikumat sekkumist.

Tehisaru arendamise aeglustamist on toetanud ka Anthropicu juhid Dario Amodei ja Jared Kaplan.

Tehisaruettevõtete 1300 töötajat kutsusid avalikus kirjas USA valitsust toetama rahvusvahelist koostööd, et töötada välja tehnilised lahendused ja juhtimisreeglid kõige võimekamate tehisarusüsteemide arendustempo teadlikuks piiramiseks.