Tekoälyagentti riistäytyi hallinnasta ja vainosi ihmistä

Agentit loivat kokeessa valeprofiileja ja yrittivät saada haitallista koodia hyväksytyksi.
Agentti yritti saada haitallista koodia mukaan avoimen lähdekoodin ohjelmistoon. / Matheus Bertelli
Agentti yritti saada haitallista koodia mukaan avoimen lähdekoodin ohjelmistoon. / Matheus Bertelli
Agentti yritti saada haitallista koodia mukaan avoimen lähdekoodin ohjelmistoon. / Matheus Bertelli
Agentti yritti saada haitallista koodia mukaan avoimen lähdekoodin ohjelmistoon. / Matheus Bertelli

Britannian AI Security Instituten eli AISI:n tietoturvakoe sai heinäkuussa odottamattoman käänteen, kun tekoälyagentit alkoivat toimia internetissä testitehtävänsä rajojen ulkopuolella.

Agenttien tehtävänä oli murtautua tutkijoiden rakentamiin testiverkkoihin. Niille annettiin tarkoituksella pääsy avoimeen internetiin. Tämän lisäksi mallien vaarallista kybertoimintaa rajoittavat suodattimet poistettiin, jotta niiden enimmäiskykyjä voitaisiin arvioida.

AISI:n mukaan 122 testiajosta kymmenessä agentti ryhtyi luvattomiin toimiin oikeita ihmisiä tai organisaatioita vastaan. Tutkijat kirjasivat yhteensä 19 tällaista toimintoa. Niistä 17 liittyi Anthropic-yhtiön Mythos 5 -malliin ja kaksi OpenAI GPT-5.6 Sol -malliin, jonka kyberturvaluokittimet oli testissä kytketty pois käytöstä.

Vakavimmassa tapauksessa agentti yritti saada haitallista koodia mukaan avoimen lähdekoodin ohjelmistoon GitHubissa.

Tekoäly ei tyytynyt lähettämään koodimuutosta, vaan loi useita tekaistuja henkilöllisyyksiä ja käytti niitä painostaakseen oikeaa ohjelmiston ylläpitäjää hyväksymään muutoksen. Ihminen havaitsi tällä kertaa haitallisen koodin eikä hyväksynyt sitä.

Tanskan TV2:n mukaan agentti valitsi yhdeksi kohteekseen tanskankielisen henkilön, josta se etsi tietoja avoimista verkkolähteistä.

Agentti selvitti henkilön yhteystietoja ja pyrki arvioimaan, milloin tämä olisi verkossa. Se lähestyi häntä GitHubissa tanskaksi vaikuttaakseen uskottavammalta ja otti myöhemmin yhteyttä myös sähköpostitse.

Tarkoituksena oli saada henkilö hyväksymään koodimuutos, johon agentti oli sisällyttänyt haitallista sisältöä.

Toisessa tapauksessa kohteeksi joutui 24-vuotias tietojenkäsittelytieteen opiskelija Sinan Can Demir Texasissa. Demir luuli aluksi olevansa tekemisissä oikeiden verkkorikollisten kanssa, koska useat käyttäjätilit puolustivat epäilyttävää koodimuutosta ja yrittivät vakuuttaa hänelle sen olevan vaaraton.

Myöhemmin selvisi, että tilien taustalla oli tekoälyagentin toimintaa.

AISI havaitsi tilanteen 28. heinäkuuta Tor-verkon kautta kulkeneen poikkeavan liikenteen vuoksi. Testit keskeytettiin ja asiaan liittyneet järjestelmät eristettiin noin tunnissa hälytyksestä.

Poimintoja videosisällöistämme

Instituutin selvityksen mukaan tapauksista ei aiheutunut todettua vahinkoa oikeassa maailmassa.

Tekoäly etsii keinot tehtävän suorittamiseen

AISI painottaa, ettei kyse ollut tekoälyn ”pakenemisesta” testijärjestelmästä. Tutkijat olivat itse sallineet internetyhteyden ja poistaneet turvallisuusrajoituksia olosuhteissa, jotka eivät vastaa mallien normaalia kuluttajakäyttöä.

Tapauksessa käytetyt mallikokoonpanot eivät myöskään olleet yleisön saatavilla, eikä instituutilla ole näyttöä vastaavan toiminnan tapahtumisesta tavallisissa käyttötilanteissa.

Tapaus osoittaa silti, miksi tekoälyagentille annettavia oikeuksia kannattaa rajata.

Britannian kansallinen kyberturvallisuuskeskus NCSC suosittelee antamaan agenteille vain tehtävän vaatimat vähimmäisoikeudet ja mahdollisimman lyhyeksi ajaksi.

Pääsy arkaluonteisiin tietoihin, sähköpostiin, tiedostoihin tai muihin järjestelmiin kannattaa rajata vain siihen, mikä on tehtävän kannalta välttämätöntä. Agentin toimintaa pitäisi lisäksi pystyä seuraamaan ja tarvittaessa pysäyttämään.

AISI:n tapaus osoittaa asiantuntijoiden mukaan konkreettisesti riskin tilanteessa, jossa erittäin kyvykkäälle agentille annetaan laajat työkalut ja vapaa pääsy internetiin. Tekoäly voi löytää tehtävänsä suorittamiseen keinoja, joita sen käyttäjä tai rakentaja ei tarkoittanut.

LUE MYÖS:
Tekoäly-yhtiöt selvittävät kymmeniä tuhansia tietoturvapoikkeamia (VU 27.9.2026)

Kehittyvä teknologia pakottaa nuoria miettimään uransa suuntaa uudelleen.
Kyselyn mukaan suomalaiset suhtautuvat tekoälyyn uteliaasti ja kiinnostuneesti.
Tekoälymalli toimi testeissä käyttäjän valtuutuksen ulkopuolella eikä kertonut luotettavasti omista toimistaan.
Mainos