OpenAI:n tekoäly murtautui ulos testiympäristöstä ja hyökkäsi oikeaan järjestelmään

Testikäytössä ollut tekoälyagentti löysi haavoittuvuuksia, joiden kautta se pääsi käsiksi internetiin.
OpenAI:n ja ChatGPT:n logot. AFP / LEHTIKUVA / MARCO BERTORELLO
OpenAI:n ja ChatGPT:n logot. AFP / LEHTIKUVA / MARCO BERTORELLO

Yhdysvaltalainen tekoäly-yhtiö OpenAI:n sisäisessä testissä käytetty tekoälygentti onnistui ohittamaan suljetun testiympäristön rajoitukset mallin kyberominaisuuksia mittaavan kokeen aikana.

Julkiseen internetiin päästyään tekoäly hyökkäsi toisen tekoäly-yhtiö Hugging Facen tietojärjestelmiin.

Tapausta blogitekstissä avannut OpenAI kertoo, että vastaavaa ei ole koskaan tapahtunut. Yhtiö kuvailee tapahtunutta ”ennennäkemättömäksi”.

Kaikki sai alkunsa, kun OpenAI kokeili uuden mallinsa kyberkyvykkyyksiä suljetussa testiympäristössä, jossa tekoälymallin ei olisi pitänyt päästä käsiksi julkiseen internetiin. Mallilta oli poistettu käytöstä keinotekoisesti asetetut rajoitteet, jotta sen todellisia kyvykkyyksiä voitiin arvioida kyberhyökkäystä jäljittelevällä harjoituksella.

Tekoälymalli ei kuitenkaan ratkaissut tehtävää normaalilla tavalla. Sen sijaan se löysi tutkimusympäristöstä haavoittuvuuksia, joiden avulla se pääsi käsiksi internetiin. Sen jälkeen se päätteli, että Hugging Facella saattaisi olla palvelimillaan harjoitukseen liittyviä aineistoja. Lopulta OpenAI:n tekoälymalli murtautui Hugging Facen järjestelmiin etsiäkseen ratkaisua sille annettuun tehtävään.

OpenAI:n mukaan mallin ”motivaatio” ei ollut vahingoittaa Hugging Facea, vaan saavuttaa sille annettu tavoite eli ratkaista testi. Kyseessä ei ole tilanne, jossa tekoäly olisi itsenäisesti halunnut karata testiympäristöstä tai tullut jollain tavalla tietoiseksi.

Tutkimustarkoituksessa OpenAI antoi mallille hyvin suuren toimintavapauden, mitä tekoäly käytti löytäen tutkimusympäristöstä ja sen käyttämissä ohjelmistoista tietoturva-aukkoja. Kyse oli ennen kaikkea epäonnistuneesta eristämisestä eikä siitä, että tekoäly olisi alkanut toimia täysin omien tavoitteidensa mukaan.

OpenAI havaitsi poikkeavan toiminnan tutkimusympäristössään, ja Hugging Face pysäytti hyökkäyksen omassa infrastruktuurissaan.

Tekoälymalli hyödynsi hyökkäyksissään ainakin yhtä nollapäivähaavoittuvuutta eli tietoturva-aukkoa, josta kukaan ei tiennyt aikaisemmin. OpenAI kertoo ilmoittaneensa haavoittuvuuksista järjestelmien kehittäjille ja jatkaneensa tutkintaa yhdessä Hugging Facen kanssa.

OpenAI:n mukaan tapaus osoittaa, että kehittyneet tekoälymallit voivat löytää ja hyödyntää uusia hyökkäysreittejä todellisissa järjestelmissä ilman pääsyä järjestelmien lähdekoodiin. Yhtiön mukaan kehittyneet kybermallit voivat tulevaisuudessa auttaa tietoturvatiimejä löytämään heikkoudet ennen hyökkääjiä.

Tekoälyajassa arvo ei synny siellä, missä pöhinä on suurinta. Se syntyy siellä, missä jokin on aidosti niukkaa.
Pauli Kiurun mukaan lainsäädäntö ei saa olla kehityksen jarru.
Uudistus voi muuttaa sovelluksen entistä enemmän karttapalvelusta arjen suunnittelu- ja opastusvälineeksi.
Mainos