Tekoäly-yhtiö OpenAI:n tekoälymallit ovat tehneet jotakin ennennäkemätöntä.
OpenAI:n tekoälymallit hyödynsivät nollapäivähaavoittuvuuksia, murtautuivat Hugging Facen palvelimille ja yrittivät huijata suorituskykytestissä.
OpenAI kuvailee tapausta ensimmäiseksi tapaukseksi laatuaan. Erityisen huolestuttavaa on, että mallit eivät vain tehneet yksittäistä virhettä, vaan kehittivät monivaiheisen hyökkäysketjun päästäkseen käsiksi tietoihin, joilla ne voisivat parantaa omaa testitulostaan.
MAINOS (ARTIKKELI JATKUU ALLA)
”Viime viikolla Hugging Face paljasti uudenlaisen tietoturvapoikkeaman sen jälkeen, kun he havaitsivat ja eristivät tekoälyagentin, joka vaaransi heidän infrastruktuurinsa. Tämä on jotakin sellaista, minkä odotamme yleistyvän yhä kyberkykyisempien mallien yleistyessä. Tutkittuamme tiedämme nyt, että tämän poikkeustapauksen aiheutti yhdistelmä OpenAI-malleja – mukaan lukien GPT-5.6 Sol ja vieläkin kyvykkäämpi esijulkaisumalli, joissa oli käytössä vähemmän kyberhyökkäysten rajoituksia arviointitarkoituksen vuoksi – sisäisen kyberkykyjen testauksen aikana”, OpenAI selittää.
Tapahtuneessa oli mukana siis useita OpenAI:n malleja, mukaan lukien hiljattain julkaistu GPT-5.6 Sol sekä arviointivaiheessa oleva, laajemmin julkaisematon malli, jonka OpenAI sanoo olevan vielä kyvykkäämpi kuin GPT-5.6 Sol.
OpenAI testasi mallien kyberkyvykkyyksiä eristetyssä sandbox-ympäristössä. Tarkoituksena oli ajaa erilaisia testejä ja pisteyttää malleja niiden suoriutumisen perusteella.
MAINOS (ARTIKKELI JATKUU ALLA)
Yksi näistä testeistä oli ExploitGym, ja OpenAI:n mukaan mallit päätyivät yrittämään testin kiertämistä sen sijaan, että ne olisivat vain ratkaisseet tehtäviä sallitulla tavalla.
OpenAI:n kertoo, että mallit käyttivät huomattavasti laskenta-aikaa ja päättelyä löytääkseen keinon murtautua ulos rajoitetusta ympäristöstä. Ne tunnistivat ja hyödynsivät löytämäänsä nollapäivähaavoittuvuutta sekä toteuttivat sarjan käyttöoikeuksien korotushyökkäyksiä, kunnes ne saivat internet-yhteyden.
Mallit havaitsivat, että Hugging Face isännöi ExploitGymiin liittyviä malleja, aineistoja ja ratkaisuja. Useita nollapäivähaavoittuvuuksia ketjuttaen ja varastettuja tunnistetietoja käyttäen mallit onnistuivat suorittamaan koodia etänä Hugging Facen palvelimilla. Tavoitteena malleilla oli käytännössä hankkia pääsy testin ratkaisuihin tai tuloksiin ja siten huijata testissä parempi pistemäärä.
Sekä OpenAI että Hugging Face havaitsivat toiminnan itsenäisesti ja pystyivät pysäyttämään haitallisen toiminnan Hugging Facen palvelimilla.
MAINOS (ARTIKKELI JATKUU ALLA)
Yhtiöt tutkivat tapausta nyt yhdessä. OpenAI on myös ottanut Hugging Facen mukaan ohjelmaansa, jonka kautta se voi käyttää OpenAI:n uusimpia malleja omien palvelujensa testaamiseen ja vahvistamiseen.
Kaiken kaikkiaan nyt nähty tapaus on herättänyt runsaasti huolta, sillä kyseessä on kylmäävä esimerkki tekoälyyn liittyvistä uudenlaisista riskeistä ja kyberuhista. Samalla se on esimerkki siitä, miten tehokkaita tekoälymallit ilman toimivia rajoituksia voivat olla kyberhyökkäysten toteuttamisessa.
Omalta osaltaan OpenAI on kertonut parantavansa ja lisäävänsä vahvempia suojauksia jatkossa tekoälymallien koulutuksen ja arviointien yhteyteen.
Mainos: Noin 1 600 000 tuotteen hintavertailu ja hintaseuranta - katso Hinta.fistä mistä saat halvimmalla






Salasana hukassa?
Etkö ole vielä rekisteröitynyt? Rekisteröidy tästä »