Amerikkalainen tekoäly-yhtiö OpenAI on perunut suunnitellun GPT-6.1 Astra -mallinsa julkaisun turvallisuustesteissä havaittujen ongelmien vuoksi, kertoo Washington Post.
Malli saattoi jatkaa tehtävien suorittamista käyttäjän antamien rajojen ulkopuolella ja jättää kertomatta toimistaan.
Tuorein Astra-versio oli tarkoitus julkaista lokakuussa muun muassa ChatGPT:n ja ohjelmistokehitykseen tarkoitetun Codexin käyttöön. Sen sanotaan olevan aiempaa kyvykkäämpi hoitamaan monimutkaisia tehtäviä alusta loppuun ilman jatkuvaa ihmisen ohjausta.
OpenAI:n turvallisuusjärjestelmistä vastaavan Saachi Jainin mukaan malli ei täyttänyt yhtiön vaatimuksia siinä, miten se pysyi tehtävänsä ja käyttäjältä saadun valtuutuksen rajoissa.
Testeissä mallin havaittiin etenevän tehtävissä kysymättä tarvittavaa lupaa ja yrittävän käyttää ulkopuolisia työkaluja tai palveluita tilanteissa, joissa siihen saattoi liittyä turvallisuusriski.
Malli osoitti edeltäjäänsä enemmän harhaanjohtavaa käyttäytymistä ja saattoi antaa väärän kuvan siitä, mitä se oli tehnyt tai jättänyt tekemättä.
Agentit ovat ylittäneet rajoja
OpenAI on joutunut viime aikoina selittelemään useita tekoälyagenttien arvaamattomaan toimintaan liittyviä tapauksia.
Yhtiö kertoi viime viikolla agenttien toimineen ennakoimattomasti muun muassa Yhdysvaltain viranomaisten verkkosivuilla. Eräässä tapauksessa agentit käsittelivät arvopaperiviranomaisen SEC ja väestönlaskennasta vastaavan Census Bureaun julkisia tietoja tavoilla, joita OpenAI ei ollut tarkoittanut.
Yhtiön mukaan SEC:n käyttäjätunnuksia tai ei-julkisia tietoja ei saatu haltuun eikä järjestelmien vaarantumisesta löytynyt näyttöä.
Verkkouutiset kertoi aiemmin syyskuussa OpenAI-agentista, joka pääsi luvatta Australian Medicare-järjestelmään liittyvään tilastopalveluun. Agentti oli törmännyt tiedonhaussaan estoihin, mutta etsinyt vaihtoehtoisia keinoja niiden kiertämiseen. Australian hallituksen mukaan järjestelmässä käsiteltiin sekä julkisia että ei-julkisia tiedostoja, mutta potilaiden henkilötietojen ei uskota vaarantuneen.
OpenAI oli jo ennen uusinta päätöstä kiristänyt kaikkein kyvykkäimpien malliensa kehityksen turvatoimia. Yhtiö on kertonut keskeyttäneensä osan koulutusajoista ja vaativansa aiempaa vahvempaa näyttöä siitä, että mallit pysyvät niille asetetuissa rajoissa.
LUE MYÖS:
Tekoäly-yhtiöt selvittävät kymmeniä tuhansia tietoturvapoikkeamia (VU 27.9.2026)