Tekoäly-yhtiöt selvittävät kymmeniä tuhansia tietoturvapoikkeamia

Tekoälymallien ongelmallinen käytös vaikuttaa olevan laajempaa kuin on tiedetty.
Tekoälysovellus Clauden verkkosivut älypuhelimella. LEHTIKUVA / ANTTI AIMO-KOIVISTO
Tekoälysovellus Clauden verkkosivut älypuhelimella. LEHTIKUVA / ANTTI AIMO-KOIVISTO
Tekoälysovellus Clauden verkkosivut älypuhelimella. LEHTIKUVA / ANTTI AIMO-KOIVISTO
Tekoälysovellus Clauden verkkosivut älypuhelimella. LEHTIKUVA / ANTTI AIMO-KOIVISTO

Suurimmat tekoäly-yhtiöt selvittävät parhaillaan valtavaa määrää tapauksia, joissa niiden edistyneimmät mallit ovat toimineet ohjeiden vastaisesti. Uutissivusto Axiosin lähteiden mukaan OpenAI:lla, Anthropicilla ja ulkopuolisilla tietoturvatutkijoilla on tutkittavanaan kymmeniä tuhansia tällaisia tapauksia.

Ne ovat kertyneet viime kuukausien aikana sekä yhtiöiden omista testeistä että mallien todellisesta käytöstä. Lähteiden mukaan kokonaismäärä voi nousta reilusti yli kymmeniin tuhansiin.

Mallit ovat muun muassa yrittäneet ohittaa niille asetettuja rajoituksia ja valvontaa, murtautua ulos eristetyistä testiympäristöistä ja ottaa verkkosivustoja hallintaansa. Joissakin tapauksissa ne ovat perustaneet omia viestitauluja tai antaneet itselleen uusia kehotteita.

Kaikki yritykset eivät onnistuneet, eikä suurimman osan tiedetä johtaneen varsinaisiin vahinkoihin. Tapausten määrä kertoo kuitenkin, että ilmiö on huomattavasti julkisuudessa esitettyä laajempi, ja lähteiden mukaan luku voi vielä kasvaa.

OpenAI on keskeyttänyt tehokkaimpien malliensa koulutuksen. Yhtiön mukaan koulutus jatkuu vasta, kun käytössä on uusia turvamekanismeja ja mallien linjausta on saatu parannettua. Toimitusjohtaja Sam Altman on myöntänyt, että tapausten selvittäminen on edennyt hitaammin kuin yhtiö toivoi.

Ainakin 53 kuvaa on päätynyt Chat GPT-käyttäjiltä järjestelmän ulkopuolelle.
TypeSafe AI -yhtiö on herättänyt suurta kiinnostusta sijoittajissa.
Tekoäly vähentää rutiinitehtäviä ja muuttaa osaamisen tarpeita.
Mainos