Suurenev mure tehisintellekti ohutuse üle on vallandanud intensiivse arutelu reguleerimise üle. Kui Andrew Yang hoiatab, et pahatahtlik isereproduktsioonivõimeline kood rikkub juba veebi õppimisandmeid, siis Sentient Labs väidab, et tehisintellekti arengu lihtsalt aeglustamine on ebatõhus ilma dünaamilise hindamise ja sõltumatu kontrolli infrastruktuurita.
Tõeline oht tehisintellekti ohutuse jaoks ei ole kiirus, vaid tsentraliseeritud kontroll

Peamised järeldused
- Dario Amodei ja kaks tehnoloogiasektori tipptegijat kutsusid üles arengut aeglustama, samas kui Andrew Yang hoiatas ohtliku isereproduktsioonivõimelise koodi eest.
- Sentient Labsi teine oskuste uuring näitas tehisintellekti mängumetrikaid, mis õhutasid vaidlusi regulatsiooni üle.
- Abhishek Saxena soovitas kolm sõltumatut järelevalvemeedet, et parandada puudulikke tehisintellekti teste, selle asemel et loota pausidele.
Petturlik kood sunnib tehnoloogiaettevõtteid looma „sünteetilisi internette“
Mõni päev pärast seda, kui Anthropicu tegevjuht Dario Amodei avaldas kirja, milles kutsus üles tehisintellekti arengut aeglustama, hoiatas endine New Yorgi linnapeakandidaat Andrew Yang, et olukorra päästmiseks võib olla juba veidi liiga hilja, kuna pahatahtlikud agendid on interneti juba saastanud isereproduktiivse koodiga.
CNBC-le antud intervjuus jagas Yang ühe nimetamata tehisintellekti laboratooriumi juhi paljastust: pahatahtlik kood on sundinud suuri tehnoloogiaettevõtteid looma „sünteetilisi internetteid“ ainult selleks, et oma mudeleid treenida. Yang väitis, et see kulukas tagasilöök õigustab selliste tööstusjuhtide nagu Amodei, Sam Altman ja Elon Musk üleskutseid reguleerida sektorit ja aeglustada tehisintellekti arengut.
Enne Yangi hoiatust olid mitmed tehisintellekti valdkonna poliitikud ja Trumpi administratsiooni ametnikud aeglustamise üleskutsetele vastu, hoiatades, et see võib anda Hiinale juhtpositsiooni ülemaailmses tehisintellekti võidujooksus. Donald Trump oli veelgi otsesem, nimetades hirme, et tehisintellekt võib põhjustada inimkonna väljasuremise, pettuseks. Teised kriitikud, nagu David Sacks, väitsid, et mures olevad tehnoloogiaettevõtete juhid peaksid ise kehtestama testimise pausid, selle asemel et lobitööd teha föderaalse regulatsiooni või laiaulatuslike moratooriumide nimel.
Kuna arutelu muutub üha enam parteiliseks vastasseisuks regulatsiooni pooldajate ja vastaste vahel, ei ole mõlema poole võtmeisikud esitanud eriti palju empiirilisi andmeid, mis kinnitaksid või ümber lükkaksid nõudmisi sunnitud aeglustamise järele. Siiski lisab Yangi viimane avaldus, mida ta esitas kui viimase hetke uudist, arutelule kiireloomulisust, pakkudes veenvaid argumente neile, kes pooldavad viivitamatute kaitsemeetmete kehtestamist.
Uuringud näitavad, et tehisintellekti agendid kasutavad hindamiskriteeriume ära
Samal ajal väidab Sentient Labs, avatud lähtekoodiga tehisintellekti uurimisorganisatsioon, et nende hiljutine uuring näib kinnitavat Amodei väidet, et agentide võimekus ületab riskijuhtimise võimet. Kirjalikes vastustes Bitcoin.com News’i küsimustele ütles Sentient Labsi strateegia- ja arengujuht Abhishek Saxena, et ettevõtte Evoskill v2 uuring pakub seda väidet toetavat „konkreetset tõendusmaterjali”.
Saxena sõnul on ettevõtte uurimisrühm uurinud, kuidas tehisintellekti agendid käituvad konkurentsipõhistes hindamiskeskkondades, eelkõige seda, mis juhtub, kui agente optimeeritakse nii, et nad saavutaksid häid tulemusi võrdlusaluste ja hindamiste puhul.
„Me täheldasime, et agendid avastavad ootamatuid strateegiaid, mis kasutavad ära pigem hindamise struktuuri ennast kui lahendavad ettenähtud ülesannet. Nad leiavad lünki selles, kuidas hindajad tulemuslikkust mõõdavad, ja õpivad optimeerima pigem mõõdikut kui aluseks olevat eesmärki,“ selgitas Saxena.
Ohutuse seisukohast on see oluline, sest see näitab, et mida võimekamaks ja iseseisvamaks tehisintellekti süsteemid muutuvad, seda keerukam peab olema hindamisinfrastruktuur – vähemalt sama keerukas kui hinnatavad süsteemid. Selle probleemi lahendamiseks on vaja seda, mida Saxena kirjeldab kui dünaamilisi, vastandlikke hindamismeetodeid, mis arenevad koos süsteemidega, mida nad mõõdavad.
Saxena rõhutab siiski, et aeglustamine ilma muudatusteta tehisintellekti süsteemide hindamise ja järelevalve viisides annab väga vähe tulemusi.
„Parem lahendus on teha suuri investeeringuid sõltumatusse hindamisse, red-teamingusse ja käitumise seireisse, et neil, kes neid süsteeme kasutusele võtavad, ja neil, keda need mõjutavad, oleks usaldusväärne teave selle kohta, millega nad tegelevad,“ ütles Sentient Labsi juht.
Suurem risk: võimu kontsentreerumine ja tsentraliseeritud ohutusväited
Samal ajal ütles Saxena Bitcoin.com Newsile, et maailma suurim oht ei seisne selles, et me liigume liiga kiiresti või liiga aeglaselt, vaid selles, et väike hulk tehisintellekti ettevõtteid kontrollib kõige võimsamaid mudeleid ning dikteerib ka seda, mida peetakse „ohutuks“.
„Me peame rajama sõltumatu infrastruktuuri, et tegelikult kontrollida väiteid, mida tehisintellekti ettevõtted oma süsteemide kohta esitavad. Kas hindamised on usaldusväärsed? Kas ohutusaruanded on täpsed? Kas välised teadlased suudavad tulemusi korrata? Kui vastus on eitav, siis ei lahenda põhiprobleemi – usaldusväärse teabe puudumist – ei kiirendamine ega aeglustamine,“ järeldas Saxena.
See artikkel tõlgiti inglise keelest tehisintellekti abil. Ingliskeelne originaalversioon on autoriteetne allikas; automaatsed tõlked võivad sisaldada ebatäpsusi, eriti juriidilises ja regulatiivses terminoloogias.












