Näitä tietotyyppejä ei kannata syöttää mihinkään yleiseen tekoälychattiin (ChatGPT, Gemini, Claude, Copilot tai vastaava):

  1. Henkilötunnus tai muu virallinen tunniste – passin, henkilökortin tai ajokortin numero.
  2. Pankki- ja korttitiedot – tilinumerot, korttinumerot, CVV-koodit.
  3. Terveystietosi – diagnoosit, reseptit, terveydentilaan liittyvät yksityiskohdat.
  4. Työnantajan luottamuksellinen materiaali – lähdekoodi, sisäiset muistiot, julkaisemattomat suunnitelmat.
  5. Toisen ihmisen henkilötiedot – kollegan, asiakkaan tai läheisen tiedot ilman hänen lupaansa.
  6. Salasanat, API-avaimet ja kirjautumistunnukset.

Syy on sama kaikissa kuudessa: kuluttajatason keskustelu voidaan oletusarvoisesti tallentaa, käyttää mallin kehittämiseen tai näyttää ihmisarvioijalle, eikä käyttäjä useinkaan tiedä, kumpaa juuri sillä hetkellä tapahtuu. Tämä ei tarkoita, että chatbotit olisivat erityisen vaarallisia verrattuna muihin verkkopalveluihin – kyse on samasta perusperiaatteesta kuin minkä tahansa kolmannen osapuolen palvelun kanssa: älä syötä sinne mitään, jonka et hyväksyisi päätyvän tallennetuksi, uudelleenkäytetyksi tai jonkun toisen ihmisen luettavaksi.

Listaa ei kannata lukea niin, että kaikki muu olisi automaattisesti turvallista kertoa – se on kuusi selkeintä, dokumentoiduilla syillä perusteltua tapausta, ei tyhjentävä luettelo.

Mitä ei kannata kertoa tekoälylle?

Lyhyt vastaus on yllä oleva kuuden kohdan lista. Jokaisella kohdalla on oma, dokumentoitu syynsä:

  • Henkilötunnus ja muut tunnisteet. Kuluttajatilien keskustelut voidaan tallentaa, käydä läpi ihmisvoimin tai käyttää koulutukseen (ks. seuraava osio) – tunniste päätyy tällöin osaksi tallennettua dataa ilman, että palveluntarjoajalla on ollut erillistä, nimenomaista perustetta juuri sen käsittelylle.
  • Pankki- ja korttitiedot. OpenAI on itse kertonut häiriöstä, jossa avoimen lähdekoodin kirjaston bugi paljasti osalle ChatGPT Plus -tilaajista liittyviä laskutustietoja (nimi, sähköposti, laskutusosoite, kortin tyyppi ja viimeiset neljä numeroa – ei koko korttinumeroa) yhdeksän tunnin ajalta. Mitä enemmän maksutietoa syötät itse keskusteluun, sitä enemmän vastaavan kaltainen tuleva ohjelmistovirhe voisi paljastaa.
  • Terveystiedot. Terveystiedot kuuluvat EU:n tietosuoja-asetuksen erityisiin henkilötietoryhmiin (GDPR:n 9 artikla), jotka vaativat tavallista tiukemman käsittelyperusteen, eikä Euroopan tietosuojaneuvoston oma ChatGPT-työryhmäraportti ole vielä ratkaissut, millä perusteella tekoälypalvelu voi ylipäätään käsitellä kehotteisiin kirjoitettua arkaluonteista tietoa.
  • Työnantajan luottamuksellinen materiaali. Samsungin työntekijät liittivät luottamuksellista lähdekoodia ja sisäisiä kokousmuistioita ChatGPT:hen kolmesti reilun kolmen viikon aikana – tapaus johti siihen, että Samsung rajoitti koko henkilöstönsä generatiivisen tekoälyn käyttöä.
  • Toisen ihmisen tiedot. Kun syötät toisen tunnistettavissa olevan ihmisen tietoja kolmannen osapuolen palveluun ilman hänen tietoaan tai lupaansa, sinusta tulee itsestäsi näiden tietojen rekisterinpitäjä EU:n tietosuoja-asetuksen tarkoittamalla tavalla.
  • Salasanat ja API-avaimet. Nämä päätyvät samaan tallennus- ja koulutuskäytäntöön kuin muukin keskustelu, ja altistuvat samalla tavalla käyttöliittymän ohjelmistovirheille kuin OpenAI:n edellä kuvatussa tapauksessa.

Tallentaako ChatGPT keskustelut?

Kyllä. OpenAI kertoo omilla tukisivuillaan, että tavallisen käytön keskustelut tallentuvat käyttäjän tilihistoriaan, ja että kuluttajatileillä (Free, Plus, Pro) keskustelusisältöä voidaan oletusarvoisesti käyttää mallien kehittämiseen, ellei käyttäjä ole erikseen kytkenyt asetusta pois päältä. Sama koskee laajemmin muitakin suosittuja avustajia, tosin eri ehdoin:

PalveluKoulutuskäyttö oletuksenaSäilytys, jos koulutus poisSäilytys, jos koulutus sallittu
OpenAI ChatGPT (Free/Plus/Pro)Kyllä, ellei käyttäjä kytke poisPoistettu keskustelu poistetaan järjestelmistä 30 päivän kuluessaEi erillistä julkaistua enimmäisaikaa – sisältyy mallin kehitysaineistoon
Google GeminiKyllä useimmilla tileillä (“Aktiivisuuden tallennus” päällä)Tarkastamaton toiminta poistuu automaattisesti käyttäjän asettamalla aikataulullaIhmisvoimin tarkastettu keskustelu jopa kolme vuotta, tilistä irrotettuna
Anthropic Claude (kuluttaja: Free/Pro/Max)Kyllä, viimeisimpien käyttöehtojen mukaan, ellei käyttäjä kytke poisPoistetaan taustajärjestelmistä 30 päivän kuluessaTunnisteettomana jopa viisi vuotta
Microsoft Copilot (organisaation tunnus tai M365-tilaus)Ei––

Voit useimmissa palveluissa kytkeä koulutuskäytön pois asetuksista, mutta se on toiminto, joka pitää itse muistaa ottaa käyttöön – ei oletus. Taulukko koskee nimenomaan kuluttajatilejä; erilliset yritys- ja rajapintatuotteet (esimerkiksi ChatGPT for Work tai palveluiden omat API-tuotteet) toimivat tyypillisesti eri, ei-oletusarvoisilla ehdoilla, eikä niitä ole eritelty tässä taulukossa.

Onko maksullisella tilillä eri säännöt?

Usein kyllä, mutta ei aina automaattisesti pelkän hintatason vuoksi – ratkaisevaa on tilityyppi ja käyttöehdot, ei se, maksaako käytöstä. Yritys- ja organisaatiotason sopimukset (esimerkiksi työpaikan hallinnoima tili) on tyypillisesti rakennettu eri koulutus- ja säilytysehdoilla kuin tavallinen kuluttajatili, koska yritysasiakkaat vaativat sitä sopimuksissaan. Tarkista aina juuri sen palvelun ja tilityypin omat, ajantasaiset ehdot ennen kuin oletat mitään – ne voivat muuttua, eikä tällä sivulla luetella jokaisen palvelun jokaista tililuokkaa erikseen.

Näkevätkö muut mitä kirjoitan?

Ei muut tavalliset käyttäjät, mutta kyllä, mahdollisesti palveluntarjoajan oma henkilöstö tai sen käyttämät ulkopuoliset arvioijat. Esimerkiksi Google kertoo omissa ehdoissaan, että osan Gemini-keskusteluista voi tarkastaa sekä sen oma henkilöstö että koulutetut ulkopuoliset palveluntarjoajat tuotteen parantamiseksi; Google kertoo myös irrottavansa tarkastettavan keskustelun käyttäjätilistä ennen tarkastusta, mutta säilyttävänsä sen silti jopa kolme vuotta riippumatta käyttäjän omista poistoasetuksista. Työpaikan tunnuksilla käytettäessä tilanne voi olla toinen: organisaation pääkäyttäjällä voi olla oikeus nähdä tai valvoa organisaation tunnuksilla käytyjä keskusteluja samaan tapaan kuin muunkin työvälineen käyttöä valvotaan.

Toinen, harvemmin ajateltu riski ei liity palveluntarjoajaan lainkaan vaan tavalliseen ohjelmistovirheeseen. OpenAI:n oma esimerkki syntyi yleisesti käytetyn avoimen lähdekoodin kirjaston bugista, ei mistään tarkoituksellisesta väärinkäytöksestä – silti se paljasti osan käyttäjien tilihistoriasta ja laskutustiedoista muille käyttäjille yhdeksän tunnin ajan. Sama voi periaatteessa tapahtua uudelleen millä tahansa palvelulla, mikä on hyvä syy pitää kynnys matalana sille, mitä ylipäätään syöttää.

Tarkista tämä ennen kuin lähetät viestin

  • Sisältääkö viesti jonkin yllä listatuista kuudesta tietotyypistä? Jos kyllä, poista se ennen lähettämistä.
  • Käytätkö tilapäistä/yksityistä keskustelutilaa, jos palvelu tarjoaa sellaisen? Se ei silti tarkoita, ettei mitään tallenneta – esimerkiksi OpenAI kertoo voivansa säilyttää tilapäisen keskustelun kopion jopa 30 päivää turvallisuussyistä, vaikka se ei näy tilihistoriassa.
  • Oletko työpaikan tunnuksilla vai omalla henkilökohtaisella tililläsi? Ehdot voivat olla erilaiset.
  • Onko koulutuskäyttöä koskeva asetus tarkistettu, jos palvelu tarjoaa sen pois kytkemisen?
  • Jos syötät toisen ihmisen tietoja, onko sinulla siihen lupa?
  • Onko kyse yleisesti saatavilla olevasta ilmaispalvelusta vai työpaikan hallinnoimasta, maksullisesta tilistä? Ehdot voivat poiketa toisistaan merkittävästi, vaikka käyttöliittymä näyttäisi samalta.
  • Onko työpaikallasi oma, kirjallinen ohjeistus tekoälyn käytöstä? Se voi olla tiukempi kuin palveluntarjoajan oma oletusasetus, ja sitä kannattaa noudattaa riippumatta siitä, mitä palvelu itse sallisi.
  • Sisältääkö viestiin liitetty kuva tai tiedosto jonkin kuudesta tietotyypistä epäsuorasti – esimerkiksi kuvakaappaus, jossa näkyy tiliote tai henkilötunnus taustalla? Sama kuuden kohdan sääntö koskee liitteitä yhtä lailla kuin itse kirjoitettua tekstiä.

Koskeeko tämä vain chatbotteja?

Ei. Samat kuusi sääntöä pätevät mihin tahansa tekoälypohjaiseen työkaluun, johon kirjoitat tai lataat tekstiä – tekstintarkistusohjelmiin, käännöstyökaluihin, muistion tiivistäjiin ja tekoälyllä varustettuihin selainlaajennuksiin. Jos työkalu lähettää syöttämäsi tekstin palvelimelle käsiteltäväksi (mikä koskee lähes kaikkia ilmaisia verkkopohjaisia työkaluja), sama kysymys pätee: kuka näkee tekstin, kauanko se säilyy, ja käytetäänkö sitä johonkin muuhun kuin vain sinun pyytämääsi tehtävään. Jos et löydä palvelun omista ehdoista suoraa vastausta tähän, turvallisin oletus on olla syöttämättä mitään yllä listatuista kuudesta tietotyypistä. Tämä koskee myös ilmaisia, selaimessa toimivia kielenkääntäjiä ja tekstintiivistäjiä, jotka eivät edes markkinoi itseään “tekoälynä” – tekninen periaate on sama riippumatta siitä, mitä nimeä palvelu käyttää itsestään.

Yksi erityistapaus on tekoäly, joka on valmiiksi rakennettu jo käytössä olevaan sovellukseen, kuten WhatsAppin sisäänrakennettu Meta AI. Koska sitä ei tarvitse erikseen avata omana sovelluksenaan, on helppo unohtaa, että samat kuusi sääntöä pätevät myös siihen heti, kun sille kirjoittaa suoraan tai mainitsee sen ryhmäkeskustelussa. Tarkempi läpikäynti siitä, mitä juuri WhatsAppin tekoäly näkee ja mitä ei, löytyy omalta sivultaan: WhatsAppin tekoäly.

Lue myös, onko ChatGPT turvallinen käyttää, ja mitä tekoäly ja tietosuoja tarkoittaa yritykselle tai työntekijälle laajemmin.

Lähteet

Usein kysyttyä

Voiko poistetun keskustelun palauttaa myöhemmin?

Ei käyttäjälle itselleen. OpenAI kertoo, että poistettu keskustelu häviää tililtä heti ja aikataulutetaan poistettavaksi palvelimilta 30 päivän kuluessa, ellei lain tai turvallisuustutkinnan vuoksi ole pakko säilyttää sitä pidempään. Vastaava periaate koskee muitakin suuria palveluntarjoajia: poisto käyttöliittymästä ei tarkoita välitöntä poistoa taustajärjestelmistä.

Onko turvallisempaa käyttää tekoälyä työpaikan tunnuksilla kuin omalla henkilökohtaisella tilillä?

Usein kyllä, mutta ei automaattisesti. Esimerkiksi Microsoftin mukaan organisaation Entra ID -tunnuksella kirjautuneen käyttäjän Copilot-kehotteita ja -vastauksia ei käytetä perustamallien kouluttamiseen – tämä on eri oletus kuin monen kuluttajatilin oma, oletuksena päällä oleva koulutuskäyttö. Tarkista silti aina oman työpaikkasi ja kyseisen palvelun ehdot, sillä ne vaihtelevat palveluntarjoajan ja tilityypin mukaan.

Mitä pitäisi tehdä, jos vahingossa lähetti jotain, mitä ei olisi pitänyt?

Poista keskustelu heti palvelusta ja käännä huomio siihen, mitä tieto oli: jos kyse oli työnantajan luottamuksellisesta materiaalista, ilmoita asiasta työpaikan IT- tai tietoturvavastaavalle samalla tavalla kuin minkä tahansa muun tietovuodon kohdalla – Samsungin tapaus johti nimenomaan tähän, kun työntekijät olivat liittäneet lähdekoodia ChatGPT:hen.