Anthropic avastas ja peatas katsed kasutada tehisarumudelit Claude bioloogiliste ja tavarelvade arendamisel, küberluures, propagandas ning pettustes, kirjutab BBC.
Claude’i rakendati ka Venemaaga seotud küberluurekampaanias ja Iraani propagandasutuse tegevuses. Viimase kaheksa kuu jooksul tuvastatud juhtumid ulatusid võltsitud kohtinguäppidest ja hotellide Wi-Fi-võrkudega seotud pettustest dissidentide leidmiseks loodud jälgimissüsteemideni.
Anthropic avaldas raporti neljapäeval, põhjendades seda veendumusega, et ettevõttel on „kohustus avalikustada meie teenuste pahatahtlik väärkasutamine“.
Ettevõtte tehnoloogiat kuritarvitasid arvatavasti riikide toetatud rühmitused, kurjategijad, nuhkvara müüjad, riiklikud propagandasutused ja poliitiliselt motiveeritud isikud, kirjutab leht.
Claude’i mudelite Haiku, Sonnet ja Opus pahatahtlik kasutamine peatati ajavahemikul 2025. aasta detsembrist 2026. aasta augustini. Claude Fable’i ja võimsamaid Mythos-klassi mudeleid kirjeldatud juhtumites ei kasutatud, välja arvatud üks mudeli destilleerimise katse. Destilleerimine tähendab väiksema tehisarumudeli treenimist suurema ja kallima mudeli abil.
Tehisaru aitas uurida biorelvi
Anthropic blokeeris teadlasi, kes kasutasid ettevõtte tehisaru viisil, mis võis toetada bioloogiliste relvade arendamist. Raportis tuuakse välja viis sellist juhtumit.
Ettevõte nimetas tehisaru bioloogilist väärkasutamist üheks kõige tõsisemaks tipptasemel tehisarumudelitega seotud riskiks. Piisavate kaitsemeetmeteta võivad sellised võimed Anthropicu hinnangul kaasa tuua katastroofilisi tagajärgi.
„Sama teavet, mida saab kasutada bioloogilise relva väljatöötamiseks, võib kasutada ka näiteks vaktsiini või mõne haiguse ravi loomiseks,“ märkis Anthropic.
Anthropicu ohuluure juht Jacob Klein selgitas New York Timesile, et olukord on väga keeruline ja nõuab põhjalikku kaalumist. „Me ei näe siin kedagi koomiksikurjategija kombel ütlemas: „Hei, ma tahan ehitada bioloogilise relva, et kõik inimesed tappa“,“ selgitas Klein.
Claude’iga arendati ka tavarelvi
Raportis kirjeldatakse kuut juhtumit, kus Claude’i kasutati tavarelvade tarkvara arendamiseks. Nende seas olid tulirelvad, raketid, relvastatud droonid, pommid ja muu laskemoon, samuti relvade sihtimis- ja juhtimissüsteemid.
Anthropic tuvastas oma tehnoloogia kasutamist ka küberrünnakutes ja mõjutustegevuses. Raportis nimetatakse häkkerirühmitust ShinyHunters ja Hiinas tegutsevaid laboreid.
Venemaal baseeruva Midnight Blizzardiga sarnase tegevusmustriga häkkerirühmitus kasutas väidetavalt tehisaru süsteemi loomiseks, mis tuvastas automaatselt pahavara avastamise turvalahenduste poolt. Seejärel kirjutas süsteem koodi ümber seni, kuni pahavara suutis kaitsest mööda pääseda.
Anthropic teatas, et on juhtumitest saadud teadmised lisanud oma tööprotsessidesse, et sellist tegevust edaspidi paremini ennetada, tuvastada ja peatada. Vajaduse korral jagas ettevõte teavet ametiasutuste ja valdkonna partneritega.
Surve tehisaru arengut pidurdada
Anthropicu tänavune esimene ohuraport ilmus pärast ettevõtte juhtiva ohutusteadlase hoiatust, et tehisaru võib järgmise kümnendi jooksul enam kui kümneprotsendilise tõenäosusega hävitada kogu inimkonna.
OpenAI juhtivteadur Jakub Pachocki kutsus 6. septembril avaldatud kirjutises tehnoloogiaettevõtteid üles arengut vabatahtlikult aeglustama, kuni vajalikud kaitsemeetmed on paigas.
„Olen mures, et keegi pole valmis masinintellekti kiire jätkuva arengu tagajärgedeks,“ kirjutas Pachocki. OpenAI jätkab tema kinnitusel kaitsemeetmete loomist, ent vaja on kogu valdkonda hõlmavaid samme.
USA demokraadist senaator Bernie Sanders on esitanud eelnõu, mis keelaks tehisliku superintellekti ning peataks ajutiselt kõige võimsamate tehisarusüsteemide arendamise.
„Kui teadlased ütlevad, et on olemas võimalus, võimalus, et sellel võib olla inimkonnale hukatuslik mõju, peab olema idioot, et mitte öelda: võtke hoog maha,“ rääkis Sanders BBC saates „Newsnight“.
