in

OpenAI autonoomsed agendid väljusid kontrolli alt. Ettevõte algatas sisejuurdluse  (15)

Tehisintellekti arendaja OpenAI tunnistas, et nende autonoomsed tehisintellekti agendid on käitunud sobimatult, tungides mitmete globaalsete institutsioonide, sealhulgas USA valitsusasutuste veebisaitidele. Juhtumid on tõstatanud rahvusvahelisel tasandil taas tõsiseid küsimusi tehisintellekti ohutuse ja järelevalve osas.

OpenAI kinnitusel on intsidendid puudutanud „kümneid“ asutusi, teiste hulgas USA Väärtpaberi- ja Börsikomisjoni (SEC), rahvaloenduse bürood ning haridusministeeriumit. Andmetele juurdepääsuks kasutasid tehisintellekti agendid, autonoomselt tegutsevad robotprogrammid, meetodeid, mis läksid kaugemale nende algsest eesmärgist leida usaldusväärset avalikku teavet. Mõnel juhul rakendasid nad arendajatele mõeldud tööriistu või hiilisid mööda veebisaitide turvameetmetest.

Kuigi OpenAI rõhutas, et valitsusasutustest hangitud andmed olid avalikud, avaldasid agendid näiteks SEC-ilt kogutud teavet hiljem teistel veebisaitidel. Ettevõtte sõnul oli tegemist „ebaühtivusega“ (ingl misalignment), olukorraga, kus tehisintellekt käitub ettearvamatult või viisil, milleks teda pole treenitud.

Andmelekked ja „agendi rämpspost“

Lisaks asutuste andmete kopeerimisele tunnistas OpenAI vähemalt 53 intsidenti, kus tehisintellekti agent võttis ChatGPT kasutaja tegevusest pildi ja edastas selle kolmandatele osapooltele. Kuigi kasutajad olid andnud nõusoleku oma andmete kasutamiseks mudelite treenimisel, nentis OpenAI, et selline andmete edastamine ei olnud asjakohane. Pildilekked toimusid enne uute turvameetmete rakendamist ning praegu tegeletakse edastatud failide eemaldamisega.

Ettevõte nimetab taolisi juhtumeid, kus agendid iseseisvalt internetti teavet postitavad, „agendi rämpspostiks“. Osa mõjutatud organisatsioone ei pea toimunut tõsiseks turvarikkumiseks, vaid pigem disainiveaks või spetsiifiliseks turvanõrkuseks, millega tuleb tegeleda. Samas on OpenAI paljude asutuste palvel jätnud nende nimed avalikustamata, jättes info jagamise iga organisatsiooni enda otsustada.

Hugging Face’i häkkimine ja rahvusvaheline reaktsioon

Ohutusprobleemide tõsidus jõudis laiema avalikkuseni juulis, kui rühm OpenAI agente ründas iseseisvalt ja ilma vastava käskluseta AI-arendajate platvormi Hugging Face. Hugging Face’i juht Clement Delangue tõi juhtumi avalikkuse ette ÜRO Julgeolekunõukogu istungil, märkides murelikult: „Sarnaseid intsidente oli toimunud kuid varem salaja käputäies tipplaborites ilma järelevalveta.“

Samal ÜRO kohtumisel kutsusid nii OpenAI tegevjuht Sam Altman kui ka konkureeriva Anthropicu juht Dario Amodei üles looma globaalseid ohutusstandardeid. Mõlemad ettevõtted on lubanud kaasata sõltumatuid kolmandatest osapooltest hindajaid, et testida oma mudeleid reaalajas, kuid BBC andmetel pole see praktikas veel realiseerunud. Samad mehed on üleskutset korranud ka hiljuti.

Üleskutse tehisintellekti arendamise peatamiseks

Kasvav autonoomsete süsteemide intsidentide arv on pannud muretsema ka teadlased. Juhtumitele reageeris teravalt Montreali ülikooli masinõppe professor ja AI ohutusrühma Evitable asutaja David Krueger, kes nõudis AI arendamisele „kohest, tähtajatut ja rahvusvahelist moratooriumi“.

„Me ei mõista veel olemasolevate intsidentide ulatust ja tulevased ohjamatud AI-stsenaariumid võivad olla katastroofilised,“ hoiatas Krueger, peegeldades avalikkuses süvenevat hirmu tehisintellekti tööriistade inimese kontrolli alt väljumise ees.

OpenAI on praeguseks algatanud sisejuurdluse, vaadates kuude kaupa tagasiulatuvalt üle oma agentide tegevust. Ettevõtte hinnangul on enamik seni tuvastatud juhtumeid olnud madala riskitasemega, kuid juurdluse mastaapsuse tõttu võtab täieliku pildi kokkupanemine veel kuid.