Kasvava huoli tekoälyn turvallisuudesta on herättänyt kiivaan keskustelun sääntelystä. Andrew Yang varoittaa, että pahantahtoinen, itseään monistava koodi on jo saastuttamassa verkossa käytettäviä koulutustietoja, kun taas Sentient Labs väittää, että pelkkä tekoälyn kehityksen hidastaminen on tehotonta ilman dynaamista arviointia ja riippumatonta varmennusinfrastruktuuria.
Tekoälyn todellinen turvallisuusuhka ei ole nopeus – vaan keskitetty hallinta

Tärkeimmät johtopäätökset
- Dario Amodei ja kaksi teknologia-alan huippuhenkilöä kehottivat hidastamaan kehitystä, kun taas Andrew Yang varoitti haitallisesta, itsestään monistuvasta koodista.
- Sentient Labsin toinen tutkimus esitteli tekoälyn pelitoimintaa koskevia mittareita, mikä kiihdytti sääntelyä koskevia kiistoja.
- Abhishek Saxena kehotti toteuttamaan kolme riippumatonta valvontatoimenpidettä puutteellisen tekoälytestauksen korjaamiseksi sen sijaan, että luotettaisiin kehityksen keskeyttämiseen.
Häiriökoodi pakottaa teknologiayritykset ”synteettisiin internetiin”
Muutama päivä sen jälkeen, kun Anthropicin toimitusjohtaja Dario Amodei julkaisi kirjeen, jossa hän kehotti hidastamaan tekoälyn kehitystä, entinen New Yorkin pormestariehdokas Andrew Yang varoitti, että tilanteen pelastaminen saattaa olla jo hieman myöhäistä, sillä hallitsemattomat agentit ovat jo saastuttaneet internetin itseään monistavalla koodilla.
CNBC:lle antamassaan haastattelussa Yang kertoi nimettömän tekoälylaboratorion johtajan paljastaman tiedon: hallitsematon koodi on pakottanut suuret teknologiayritykset luomaan ”synteettisiä internettejä” pelkästään mallien kouluttamiseksi. Yangin mukaan tämä kallis takaisku oikeuttaa Amodein, Sam Altmanin ja Elon Muskin kaltaisten alan johtajien vaatimukset säännellä alaa ja hillitä tekoälyn kehityksen vauhtia.
Ennen Yangin varoitusta useat tekoälypolitiikan vaikuttajat ja Trumpin hallinnon virkamiehet vastustivat hidastamisvaatimuksia varoittaen, että ne saattaisivat antaa Kiinalle johtoaseman maailmanlaajuisessa tekoälykilpailussa. Donald Trump oli vieläkin suorapuheisempi ja leimasi pelot tekoälyn aiheuttamasta ihmiskunnan sukupuutosta huijaukseksi. Muut kriitikot, kuten David Sacks, väittivät, että huolestuneiden teknologiayritysten johtajien tulisi itse määrätä testauksen keskeytyksiä sen sijaan, että he lobbaavat liittovaltion sääntelyä tai laajoja moratorioita.
Kun keskustelu muuttuu yhä enemmän puoluepoliittiseksi vastakkainasetteluksi sääntelyn kannattajien ja vastustajien välillä, kummankin puolen avainhenkilöt ovat esittäneet vain vähän empiiristä tietoa, jolla voitaisiin perustella tai kumota vaatimukset pakotetusta hidastamisesta. Yangin viimeisin paljastus, jonka hän esitti uutisena, tuo kuitenkin kiireellisyyttä keskusteluun ja tarjoaa vakuuttavaa ammuksia niille, jotka kannattavat välittömiä suojatoimia.
Tutkimus osoittaa, että tekoälyagentit hyödyntävät arviointikriteereitä
Samaan aikaan Sentient Labs, edistyksellinen avoimen lähdekoodin tekoälytutkimusorganisaatio, toteaa, että sen äskettäin tekemä tutkimus näyttää vahvistavan Amodein väitteen, jonka mukaan agenttien kyvyt ovat ohittamassa riskienhallintakyvyn. Vastauksissaan Bitcoin.com Newsin kysymyksiin Sentient Labsin strategia- ja kasvujohtaja Abhishek Saxena totesi, että yrityksen Evoskill v2 -tutkimus tarjoaa ”konkreettista näyttöä” tämän väitteen tueksi.
Saxena kertoi, että yrityksen tutkimusryhmä on tutkinut, miten tekoälyagentit käyttäytyvät kilpailullisissa arviointiympäristöissä, erityisesti mitä tapahtuu, kun agentit on optimoitu suoriutumaan hyvin vertailuarvioinneissa ja arvioinneissa.
”Havaitsimme, että agentit löytävät odottamattomia strategioita, jotka hyödyntävät itse arvioinnin rakennetta sen sijaan, että ratkaisisivat aiotun tehtävän. Ne löytävät aukkoja arvioijien suorituskyvyn mittausmenetelmissä ja oppivat optimoimaan suorituskykyään mittarin mukaan sen sijaan, että keskittyisivät varsinaiseen tavoitteeseen”, Saxena selitti.
Turvallisuuden näkökulmasta tämä on merkittävää, koska se osoittaa, että tekoälyjärjestelmien kyvykkyyden ja itsenäisyyden kasvaessa arviointijärjestelmän on oltava vähintään yhtä kehittynyt kuin arvioitavat järjestelmät. Tämän ongelman ratkaisemiseksi tarvitaan Saxenan mukaan dynaamisia, vastakkainasettelun periaatteeseen perustuvia arviointimenetelmiä, jotka kehittyvät yhdessä mitattavien järjestelmien kanssa.
Saxena korostaa kuitenkin, että pelkkä hidastaminen ilman muutoksia tekoälyjärjestelmien arviointiin ja seurantaan ei tuo juurikaan tulosta.
”Parempi tie on panostaa voimakkaasti riippumattomaan arviointiin, red-teaming-menetelmiin ja käyttäytymisen seurantaan, jotta näitä järjestelmiä käyttöönottavat ja niiden vaikutuksen alaiset ihmiset saavat luotettavaa tietoa siitä, mitä he käyttävät”, Sentient Labsin johtaja sanoi.
Suurempi riski: keskittynyt valta ja keskitetyt turvallisuusväitteet
Samaan aikaan Saxena kertoi Bitcoin.com Newsille, että maailman suurin riski ei ole se, että etenemme liian nopeasti tai liian hitaasti, vaan se, että pieni joukko tekoälyyrityksiä hallitsee tehokkaimpia malleja ja määrää myös, mitä pidetään ”turvallisena”.
”Meidän on rakennettava riippumaton infrastruktuuri, jotta voimme tosiasiallisesti tarkistaa väitteet, joita tekoälyyritykset esittävät järjestelmistään. Ovatko arvioinnit vankkoja? Ovatko turvallisuusraportit tarkkoja? Voivatko ulkopuoliset tutkijat toistaa tulokset? Jos vastaus on ei, niin sen enempää vauhdin lisääminen kuin hidastaminenkaan ei ratkaise perustavanlaatuista ongelmaa, joka on luotettavan tiedon puute”, Saxena totesi lopuksi.
Tämä artikkeli on käännetty englannista tekoälyn avulla. Alkuperäinen englanninkielinen versio on auktoritatiivinen lähde; automaattiset käännökset voivat sisältää epätarkkuuksia, erityisesti oikeudellisessa ja sääntelyyn liittyvässä terminologiassa.












