OpenAI on päättänyt olla julkaisematta uutta GPT-6.1 Astra -tekoälymalliaan, koska se ei yhtiön omien testien perusteella täyttänyt turvallisuudelle asetettuja vaatimuksia. Kyseessä olisi ollut agenttinen tekoälymalli, joka pystyy esimerkiksi selaamaan internetiä ja käyttämään sovelluksia itsenäisesti.
OpenAI turvallisuusjärjestelmistä vastaavan Saachi Jainin mukaan malli ei täyttänyt vaatimuksia erityisesti siinä, miten se pysyy sille annetussa toimintarajassa ja käyttöoikeuksissa sekä miten se kertoo käyttäjälle tekemistään toimista. Jainin mukaan käyttäjille julkaistavien mallien kohdalla yhtiö asettaa turvallisuudelle ja tekoälyn toiminnan ohjattavuudelle erityisen korkean riman.
Päätös on poikkeuksellinen, sillä kyseessä on suuri tekoälykehittäjä, joka on päättänyt vetää uuden mallin julkaisusuunnitelman pois turvallisuussyistä. Taustalla painavat myös viime kuukausien tapahtumat, joissa OpenAI tekoälyjärjestelmät ovat päätyneet tekemään luvattomia toimia internetissä.
OpenAI kertoi tiistaina tarkemmin kesäkuussa tapahtuneista tapauksista, joissa sen tekoälyagentit pääsivät ilman lupaa australialaisten viranomaisten verkkosivuille ja järjestelmiin. Yhtiö kertoi käynnistäneensä tutkinnan elokuussa ja ilmoittaneensa tapauksista asianomaisille organisaatioille syyskuussa. OpenAI myönsi samalla, että viranomaisille olisi pitänyt kertoa tilanteesta nopeammin ja suoremmin.
Tapaus on osa laajempaa keskustelua agenttisista tekoälyjärjestelmistä. Kun tekoäly ei enää vain vastaa kysymyksiin vaan voi myös suorittaa tehtäviä itsenäisesti, mahdolliset virheet voivat ulottua huomattavasti tavallista chatbot-keskustelua pidemmälle. OpenAI kertoo nyt kehittävänsä uusia käytäntöjä tekoälyyn liittyvien tietoturvapoikkeamien tunnistamiseen ja ilmoittamiseen.
OpenAI järjestää tänään San Franciscossa vuosittaisen DevDay-kehittäjätapahtumansa, jossa yhtiöltä odotetaan uusia julkistuksia. Vielä ei ole tiedossa, esitelläänkö tapahtumassa Astra-mallista uusi versio. Toistaiseksi viesti on kuitenkin selvä, jos tekoäly ei pysy sille annetuissa rajoissa, sitä ei päästetä vapaaksi edes OpenAI omasta laboratoriosta.