Tekoälyn kanssa käytyjä yksityisiä keskusteluja päätyi Googleen – mukana CV:itä, työprojekteja ja henkilökohtaisia tietoja Kommentit pois päältä artikkelissa Tekoälyn kanssa käytyjä yksityisiä keskusteluja päätyi Googleen – mukana CV:itä, työprojekteja ja henkilökohtaisia tietoja

Sadat Anthropicin Claude-tekoälypalvelun käyttäjien keskustelut ovat olleet julkisesti löydettävissä hakukoneiden kautta. BBC:n mukaan osa keskusteluista sisälsi henkilötietoja, työprojekteihin liittyviä luottamuksellisia tietoja sekä muita arkaluonteisia sisältöjä.

Keskustelut löytyivät esimerkiksi Googlesta tekemällä Claude-sivustoon kohdistetun haun. Vaikka hakutulokset on sittemmin poistettu, monet niistä ehtivät levitä verkossa ennen kuin Anthropic esti niiden indeksoinnin.

Jakolinkki saattoi päätyä myös hakukoneisiin

Tapauksen taustalla ei ollut tietomurto, vaan Clauden Share-ominaisuus. Kun käyttäjä jakoi keskustelun linkin avulla, keskustelu muuttui julkisesti saavutettavaksi.

Anthropic huomauttaa, että käyttäjät päättävät itse keskustelujen jakamisesta, eikä linkkejä voi arvata sattumalta. Yhtiön mukaan julkisesti jaettu sisältö voidaan kuitenkin indeksoida hakukoneisiin samalla tavoin kuin mikä tahansa muukin verkkosivu.

Ongelmana on, ettei jakotoiminto kerro käyttäjälle selkeästi, että keskustelu voi päätyä myös Googlen hakutuloksiin eikä pelkästään henkilöille, joille linkki lähetetään.

Keskusteluissa näkyi henkilötietoja ja yrityssalaisuuksia

Reddit-käyttäjät löysivät hakukoneista yli 200 Claude-keskustelua. Mukana oli muun muassa:

  • ansioluetteloita nimi- ja yhteystietoineen
  • yritysten sisäisiä pilvipalveluprojekteja
  • terveydenhuoltoon liittyvää tutkimusmateriaalia
  • yksityisiä keskusteluja
  • erilaisia henkilökohtaisia kysymyksiä ja kokeiluja tekoälyn kanssa.

Yhdessä keskustelussa käyttäjä pyysi Claudea kirjoittamaan julkaisemattoman blogitekstin yrityksen pilviturvallisuushankkeesta. Toisessa käyttäjä kysyi, kuinka voisi kirjaimellisesti muuttua yhdeksänhäntäiseksi ketuksi.

Vastaavia tapauksia on nähty aiemminkin

Claude ei ole ensimmäinen tekoälypalvelu, jonka käyttäjien keskusteluja on päätynyt hakukoneisiin. Viime vuonna vastaava ongelma havaittiin myös ChatGPT:ssä, minkä jälkeen OpenAI muutti tapaa, jolla jaettuja keskusteluja voitiin löytää verkosta.

Myös xAI:n Grok-chatbotin keskusteluja päätyi viime vuonna julkisesti haettaviksi.

Googlen mukaan hakukone ei päätä, mitä sisältöä indeksoidaan, vaan verkkosivustojen omistajat voivat itse estää sivujen näkymisen hakutuloksissa. Anthropic onkin sittemmin estänyt Claude-keskustelujen indeksoinnin hakukoneisiin.

Tapauksen myötä muistutus on jälleen ajankohtainen: tekoälypalveluihin ei kannata syöttää arkaluonteisia henkilötietoja tai luottamuksellista yritysmateriaalia, vaikka keskustelu tuntuisi yksityiseltä.

Tietomurto paljasti Sunon salaisuudet: Tekoäly-musiikkigeneraattori imuroi koulutusdatansa YouTubesta ja podcast-syötteistä Kommentit pois päältä artikkelissa Tietomurto paljasti Sunon salaisuudet: Tekoäly-musiikkigeneraattori imuroi koulutusdatansa YouTubesta ja podcast-syötteistä


Tekoälypohjainen musiikkigeneraattori  on joutunut vakavan tietomurron kohteeksi, kertoo 404 Media -julkaisu. Hakkeri paljasti tehneensä yhtiöön marraskuussa toimitusketjuhyökkäyksen, jonka avulla hän pääsi käsiksi työntekijän tunnistetietoihin. Tämän seurauksena haltuun saatu lähdekoodi paljastaa Sunon kaapineen luvattomasti vuosikymmenten edestä audiomateriaalia suoraan YouTube Musicista, Deezeristä, Genius-palvelusta, stokin musiikkikirjastoista sekä podcastien RSS-syötteistä.

Suno on aiemmin myöntänyt kouluttavansa tekoälymallejaan avoimesta internetistä löytyvillä ”julkisesti saatavilla olevilla musiikkitiedostoilla”. Yhtiö on perustellut tekijänoikeudella suojatun materiaalin käyttöä fair use -oikeusperiaatteella. Haasteita asettavat kuitenkin suuret levy-yhtiöt, jotka parhaillaan haastavat Sunoa oikeuteen. Kantajien mukaan YouTuben suojausten tahallinen kiertäminen datan kaavintaa varten rikkoo suoraan Yhdysvaltain tekijänoikeuslakia (DMCA) sekä YouTuben omia käyttöehtoja.

Asiakastiedot vuotivat luottokortteja myöten – Yhtiö vaikeni kuukausiksi

Tekijänoikeuskiistojen lisäksi tietomurto paljasti Sunon asiakastietojen vaarantuneen. Hakkerin raportoidaan päässeen käsiksi Stripe-maksupalvelussa oleviin asiakastietoihin, kuten sähköpostiosoitteisiin, puhelinnumeroihin sekä osittaisiin luottokorttien numeroihin.

Suno ei tiedottanut asiakkaitaan marraskuussa 2025 tapahtuneesta tietomurrosta. Julkisuuteen antamassaan lausunnossa yhtiö kuvailee tapahtunutta ainoastaan ”rajoitetuksi tietoturvaloukkaukseksi, joka saatiin nopeasti haltuun”.

Kaavintasyytökset riivaavat alan muitakin toimijoita

Suno ei ole syytösten kanssa yksin, sillä myös sen kilpailijaa Udioa on syytetty datan imuroinnista YouTubesta. Ketju ulottuu vieläkin syvemmälle tech-maailmaan, sillä YouTuben emoyhtiö Google kohtaa parhaillaan vastaavia tekijänoikeusloukkaussyytöksiä useilta suurilta kirjakustantajilta.

Tapaus korostaa entisestään -yhtiöiden ja perinteisten sisällöntuottajien välistä kuilua, jossa rajanvetoa luvallisen koulutusdatan ja suoran piratismin välillä haetaan nyt oikeussalien kautta.

Tekoälyskandaali ravistelee Saksan mediaa – kuka lopulta vastaa koneen kirjoittamista sanoista? Kommentit pois päältä artikkelissa Tekoälyskandaali ravistelee Saksan mediaa – kuka lopulta vastaa koneen kirjoittamista sanoista?

Tekoälyn käyttö mediassa on noussut Saksassa kuumaksi puheenaiheeksi, kun tekoälyyn liittyvät epäilyt ja virheet ovat herättäneet keskustelua siitä, missä menee ihmisen ja koneen vastuun raja. Kysymys kuuluu: jos kirjoittaa, kuka kantaa vastuun, kun teksti menee pieleen?

Kohun keskellä on ollut Tagesspielel -lehden entinen kustantaja ja päätoimittaja Stephan-Andreas Casdorff, jonka on väitetty käyttäneen tekoälyä puheiden ja kirjoitusten valmistelussa. Saksalaisissa lehdissä tekoälyä käytetään työkaluna, mutta tapaus on herättänyt keskustelua siitä, pitäisikö tekoälyn käytöstä kertoa avoimemmin esimerkiksi politiikassa ja mediassa.

Kuva: Die Zeit

Samaan aikaan Saksassa on käyty laajempaa keskustelua tekoälyn tuottaman sisällön vastuusta. Müncheniläinen oikeusistuin katsoi kesäkuussa, että Google voidaan pitää vastuussa tekoälyn tuottamista virheellisistä vastauksista, koska tekoälyn muodostama yhteenveto ei ole vain lista hakutuloksia vaan uuden sisällön tuottamista.

Tekoäly lupaa nopeuttaa uutistyötä, tekstien tekemistä ja tiedon käsittelyä, mutta samalla se tuo mukanaan uudenlaisia ongelmia. Kone voi kirjoittaa vakuuttavasti myös silloin, kun se on väärässä – vähän kuin itsevarma harjoittelija, joka palauttaa työnsä nopeasti mutta unohti tarkistaa faktat.

Saksassa käytävä keskustelu voi vaikuttaa laajemminkin siihen, miten uutistoimitukset, yritykset ja julkiset toimijat käyttävät tekoälyä tulevaisuudessa. Ehkä tulevaisuuden tärkein kysymys ei olekaan, osaako tekoäly kirjoittaa – vaan kuka allekirjoittaa lopputuloksen.