OpenAI, Anthropic ja riippumattomat tietoturvatutkijat selvittävät jopa kymmeniätuhansia tapauksia, joissa kehittyneet tekoälymallit ovat toimineet odottamattomasti tai kiertäneet niille asetettuja rajoituksia. Tapaukset ovat syntyneet viime kuukausina sekä sisäisissä että laajemmissa turvallisuustesteissä.
Asiasta kertoo Axios-julkaisu lähteisiinsä perustuen.
Kaikki tapaukset eivät ole johtaneet vahinkoon, ja suuri osa on tapahtunut tarkoituksellisissa red teaming -testeissä, joissa malleja yritetään nimenomaan saada rikkomaan sääntöjä turvallisuuspuutteiden löytämiseksi.
MAINOS (ARTIKKELI JATKUU ALLA)
Axiosin mukaan joukossa on kuitenkin myös tapauksia, joissa agentit ovat esimerkiksi kiertäneet valvontaa, poistuneet eristetyistä ympäristöistä ja ottaneet haltuunsa verkkopalveluja.
Monista yksittäisistä tapauksista on raportoitu viime aikoina, mutta jopa kymmenientuhansien tapausten mittakaava on uutta tietoa. Samalla on toki hyvä muistaa, että tekoäly-yhtiöt ajavat malleillaan esimerkiksi satojatuhansia tai jopa enemmän testejä, joten pieni prosenttiosuus poikkeavaa käyttäytymistä voi tuottaa suuren absoluuttisen tapausmäärän.
Osa tapauksista voi joissain tilanteissa osua myös rikosoikeudellisesti ongelmalliselle alueelle, jolloin ajan myötä tapauksia voitaisiin käsitellä oikeudessa, jolloin määriteltäisiin tekoälymalleja kehittäneiden yhtiöiden vastuuta niiden toiminnasta.
MAINOS (ARTIKKELI JATKUU ALLA)
Erityisesti OpenAI on ollut viime viikkoina useiden näkyvien tapausten keskellä. Reuters raportoi aiemmin, että yhtiö selvittää edelleen laajaa joukkoa agenttien ei-toivottua toimintaa sen jälkeen, kun agentit murtautuivat Hugging Face -palveluun. OpenAI kertoi lisäksi, että sen agentit olivat vuotaneet verkkoon 53 ChatGPT-käyttäjien kuvaa.
Australiassa hallitus puolestaan kertoi OpenAI:n tekoälyagentin päässeen kesäkuussa luvatta hallituksen terveystietoportaaliin.
Raportoidusti OpenAI on nyt keskeyttänyt kaikkein kyvykkäimpien malliensa koutuksen ja aikoo jatkaa sitä vasta, kun lisäsuojauksia ja alignment-parannuksia on otettu käyttöön.
Axiosin haastattelemien asiantuntijoiden mukaan keskeinen haaste tekoälymallien turvallisuuden kehittämisessä on se, että agentit on suunniteltu suorittamaan tehtäviä sitkeästi ja löytämään vaihtoehtoisia toimintatapoja. Tämä tekee kaikkien mahdollisten väärinkäytösten ennakoinnista vaikeaa.
Mainos: Noin 1 600 000 tuotteen hintavertailu ja hintaseuranta - katso Hinta.fistä mistä saat halvimmalla






Salasana hukassa?
Etkö ole vielä rekisteröitynyt? Rekisteröidy tästä »