Anthropic aikoo ottaa käyttöön koneellisesti tunnistettavat merkinnät Claude-tekoälyn tuottamaan sisältöön. Tekstiin upotetaan näkymätön vesileima, kun taas tuettuihin tiedostoihin voidaan lisätä digitaalisesti allekirjoitettua alkuperämetadataa. Muutokset liittyvät Euroopan unionin uusiin tekoälyn läpinäkyvyyttä koskeviin vaatimuksiin.
Anthropic kertoo, että uudet Claude-mallit merkitsevät tekoälyn tuottaman sisällön heti julkaisustaan lähtien. EU:ssa 2. elokuuta 2026 tai sen jälkeen julkaistut Claude-mallit tukevat koneellisesti luettavia merkintöjä. Nykyisten mallien osalta käyttöönotto on vielä työn alla.
Tekstin kohdalla merkintä toteutetaan niin sanotulla näkymättömällä vesileimalla. Se ei näy käyttäjälle eikä Anthropicin mukaan muuta tekstin merkitystä, laatua tai luettavuutta. Vesileima on kuitenkin tarkoitettu tunnistettavaksi erityisillä työkaluilla.
Anthropic kertoo merkinnän olevan osa itse Claude-mallin tuottamaa tekstiä. Sen vuoksi sen pitäisi kulkea tekstin mukana myös silloin, kun sisältö kopioidaan ja liitetään esimerkiksi toiseen palveluun. Yhtiön mukaan merkintä voi säilyä myös joidenkin tekstin muokkausten jälkeen.
Anthropic ei kuitenkaan ole vielä kertonut tarkasti, millä teknisellä menetelmällä tekstin vesileima toteutetaan. Yhtiö kertoo julkaisevansa tulevaisuudessa lisää teknisiä tietoja sekä työkaluja, joiden avulla käyttäjät ja kolmannet osapuolet voivat tunnistaa Claude-sisällön.
Kuvissa käytetään C2PA-standardia
Kuvien ja muiden tuettujen tiedostojen kohdalla Anthropic käyttää toisenlaista menetelmää. Niihin voidaan lisätä C2PA-standardin mukaista alkuperämetadataa, joka kertoo tiedoston alkuperästä ja sen käsittelystä. C2PA on jo käytössä useissa alan palveluissa ja työkaluissa.
Merkinnät eivät rajoitu pelkästään Claude-verkkopalveluun. Anthropic kertoo niiden koskevan tuettuja Claude-palveluita, kuten API-rajapintaa, Claude Codea, Claude Coworkia ja Claude Tagia. Merkintöjä käytetään myös silloin, kun Claudea käytetään esimerkiksi AWS:n, Google Cloudin tai Microsoft Foundryn kautta.
Anthropic kertoo soveltavansa merkintöjä maailmanlaajuisesti eikä ainoastaan EU:ssa. Taustalla ovat kuitenkin erityisesti EU:n uudet tekoälyn läpinäkyvyyttä koskevat vaatimukset, jotka tulivat voimaan 2. elokuuta. Olemassa oleville tekoälytuotteille on säädetty neljän kuukauden siirtymäaika, minkä vuoksi nykyisten Claude-mallien merkintöjen käyttöönotto jatkuu myöhemmin.
Vesileima ei takaa täydellistä tunnistamista
Järjestelmä ei myöskään tee tekoälyn tunnistamisesta aukotonta. Esimerkiksi C2PA-metadata voi kadota tiedostosta, jos sitä käsitellään tai ladataan palveluun, joka ei säilytä alkuperäisiä metatietoja. Myös tekstin vesileiman todellinen kestävyys jää nähtäväksi, sillä Anthropic ei ole vielä julkaissut menetelmän teknisiä yksityiskohtia.
Yhtiö korostaa itsekin, ettei tunnistettavan merkinnän puuttuminen tarkoita automaattisesti sitä, ettei sisältö olisi tekoälyn tuottamaa. Vesileimojen tarkoituksena on ennen kaikkea tehdä tekoälyn tuottaman sisällön alkuperän selvittämisestä nykyistä helpompaa.
Muutos on osa laajempaa kehitystä, jossa Tekoäly-yhtiöt pyrkivät tekemään generatiivisen tekoälyn tuottamasta sisällöstä koneellisesti tunnistettavaa. EU:n sääntelyssä tällaisia menetelmiä ovat esimerkiksi vesileimat, metadata ja muut alkuperän todentamiseen käytettävät teknologiat.