Tekoälyn perusteet: mikä on tekoäly ja miten se toimii?
Mikä on tekoäly?
Tekoäly (englanniksi artificial intelligence, AI) tarkoittaa tietokoneohjelmia, jotka tekevät asioita, joita on totuttu pitämään ihmisen älyn alueena: tunnistavat puhetta ja kuvia, käsittelevät ja tuottavat kieltä sekä laativat ennusteita. Nykyinen tekoäly perustuu enimmäkseen siihen, että ohjelma oppii säännönmukaisuudet suuresta määrästä dataa sen sijaan, että ihminen kirjoittaisi kaikki säännöt valmiiksi.
Tekoäly ja AI ovat siis sama asia. Kumpaakaan sanaa ei kannata pelätä, mutta ei myöskään pitää taikasanana: molemmat tarkoittavat ohjelmistoa, joka käsittelee dataa ja tuottaa sen perusteella tuloksen. Wikipedia mainitsee rinnakkaisnimenä myös keinoälyn.
Kirjoitan tämän oppaan käyttäjän ja testaajan näkökulmasta. Työskentelen päivätyökseni generatiivisen tekoälyn testauksen parissa finanssialalla ja olen testannut ChatGPT:tä siitä asti, kun se julkaistiin marraskuussa 2022. Siksi tällä sivulla on määritelmien lisäksi se, minkä perusoppaat yleensä ohittavat: mistä osista ChatGPT:n kaltainen palvelu koostuu ja miksi sillä on väliä.
Miten tekoäly toimii?
Kun puhutaan nykyisestä tekoälystä, kyse on käytännössä aina koneoppimisesta, oli palvelu sitten ChatGPT tai Google Kääntäjä. Tekoäly on yläkäsite, koneoppiminen tapa toteuttaa sitä ja syväoppiminen yksi koneoppimisen menetelmistä. Generatiivinen tekoäly ja kielimallit perustuvat syväoppimiseen ja edustavat alan tuoreinta kehitystä.
Koneoppiminen
Koneoppiminen (machine learning) on lähestymistapa, jossa ohjelmaa ei koodata sääntö kerrallaan. Sille näytetään iso määrä esimerkkejä, ja se löytää datasta itse säännönmukaisuudet. Lopputuloksena syntyy koulutettu malli, joka osaa käsitellä myös uutta, ennen näkemätöntä dataa. Kun sähköpostiohjelma oppii tunnistamaan roskapostin, se ei toimi valmiin sääntölistan mukaan – se on ”nähnyt” miljoonia roskaposteja ja poiminut niistä, millaiset piirteet toistuvat.
Syväoppiminen
Syväoppiminen (deep learning) on koneoppimisen alalaji, joka nojaa keinotekoisiin neuroverkkoihin: useista kerroksista koostuviin laskennallisiin malleihin, jotka on löyhästi mallinnettu aivojen toiminnan mukaan. Mitä enemmän kerroksia ja dataa, sitä monimutkaisempia asioita malli pystyy oppimaan. Puheentunnistus, kuvantunnistus ja kielimallit nojaavat lähes poikkeuksetta syväoppimiseen.
Generatiivinen tekoäly
Siinä missä perinteinen koneoppiminen luokittelee tai ennustaa, generatiivinen tekoäly tuottaa uutta sisältöä: tekstiä, kuvia, koodia tai ääntä. Ero näkyy arjessa näin: roskapostisuodatin kertoo, onko viesti roskapostia, mutta generatiivinen malli kirjoittaa viestin.
Kielimalli
Kielimalli on generatiivisen tekoälyn tunnetuin muoto ja ChatGPT:n kaltaisten palvelujen ydin. Näissä palveluissa käytetään suuria kielimalleja (englanniksi large language model, LLM), jotka on koulutettu valtavalla tekstimäärällä. Kielimallin tehtävä on ennustaa, mikä sana tai sanan osa sopii seuraavaksi kontekstiin. Kun ennustus toistetaan sana kerrallaan, syntyy kokonainen vastaus. Lopputulos voi vaikuttaa yllättävän ymmärtävältä, vaikka kyse on tilastollisesta ennustamisesta, ei ajattelusta samassa mielessä kuin ihmisellä.
Tiivistettynä erot näyttävät tältä:
| Tekniikka | Mitä se tekee | Esimerkki |
|---|---|---|
| Tavallinen ohjelma | Noudattaa ihmisen kirjoittamia sääntöjä | Laskin, verkkokaupan alennuskoodin tarkistus |
| Koneoppiminen | Oppii datasta ja luokittelee tai ennustaa | Roskapostisuodatin, suoratoistopalvelun sarjavinkit |
| Generatiivinen tekoäly | Tuottaa uutta tekstiä, kuvaa, koodia tai ääntä | ChatGPT, kuvageneraattorit |
Malli, sovellus ja työkalut: mitä ChatGPT:n sisällä tapahtuu?
Kun käytät ChatGPT:tä, Copilotia tai muuta tekoälypalvelua, käytössä on kolme eri osaa. Monet väärinkäsitykset syntyvät, kun näitä osia sekoitetaan keskenään.
- Kielimalli tuottaa tekstiä. Se ei itse näe internetiä, avaa tiedostojasi tai lähetä viestejä. Se ei varsinaisesti tiedä mitään, vaan muodostaa vastauksensa sen pohjalta, mitä se on oppinut koulutusdatastaan ja mitä keskustelussa on sille kerrottu. Keskusteluun kuuluvat myös työkalujen hakemat tiedot.
- Sovellus on se, minkä näet ruudulla. Tekoälysovellukset, kuten ChatGPT ja Copilot, kokoavat keskustelun, välittävät sen mallille ja näyttävät vastauksen. Sovellus myös päättää, mitä työkaluja mallilla on käytössään ja milloin sinulta kysytään lupa.
- Työkalut ovat toimintoja, jotka sovellus suorittaa mallin pyynnöstä: verkkohaku, tiedoston lukeminen, koodin ajaminen tai yhteys sähköpostiin ja kalenteriin.
Esimerkki: kysyt jotain tuoretta
Kysyt tekoälyltä, mitä junalippu Helsingistä Tampereelle maksaa huomenna. Kielimalli ei voi tietää huomisen hintaa, koska sen koulutusdata on kerätty aiemmin. Jos sovelluksessa on verkkohaku, malli pyytää sovellusta etsimään tiedon verkosta. Sovellus palauttaa hakutulokset mallille, ja malli kirjoittaa vastauksen niiden pohjalta, yleensä lähdelinkkien kanssa. Jos hakua ei ole käytössä, malli vastaa koulutusdatansa varassa, ja vastaus voi olla vanhentunut tai kokonaan keksitty.
Samalla tavalla syntyi osa tästäkin sivusta. Väliotsikoiksi nostetut kysymykset, kuten ”Mitä ei kannata kysyä tekoälyltä?”, on poimittu Googlen hakutuloksista omalla SEO-MCP-palvelimellani. MCP on tapa liittää tekoälysovellukseen omia työkaluja. Kielimalli pyysi sovellusta hakemaan työkalulla, mitä ihmiset kysyvät Googlelta tekoälyn perusteista. Ilman työkalua se olisi joutunut arvaamaan.
Miksi tällä jaolla on väliä
Kun sovellus näyttää lähteet vastauksen yhteydessä, tieto on yleensä haettu työkalulla. Vastauksen kirjoittaa silti malli, ja se voi keksiä myös uskottavan näköisen osoitteen, jota ei ole olemassa. Siksi lähde kannattaa avata ja katsoa, sanooko se samaa kuin vastaus. Jos lähteitä ei näy, malli on todennäköisesti vastannut pelkän koulutusdatansa ja keskustelun varassa.
Malli ei tunne tilannettasi. Se ei tiedä yhdistyksesi sääntöjä tai yrityksesi asiakkaita, ellei niitä ole kerrottu keskustelussa. Siksi hyvä promptaus on ennen kaikkea oikean taustan antamista mallille. Jos sovellus tuntuu muistavan aiemmat keskustelusi, se on tallentanut tietoa ja liittänyt sen uuteen keskusteluun – malli itse ei muista.
Malli ehdottaa, sovellus toteuttaa. Kun sovellus antaa mallin käyttää työkaluja kierros kierrokselta, kunnes tehtävä on valmis, puhutaan tekoälyagentista. Agentti voi esimerkiksi käydä läpi saapuneet sähköpostit, luonnostella niihin vastaukset ja ehdottaa tapaamisaikoja kalenteristasi. Silloin ratkaisevaa on, mitä oikeuksia sille annetaan ja missä kohdassa ihminen tarkistaa työn. Testaajille ja kehittäjille käyn tämän läpi syvemmin teknisessä koulutuksessa.
Mihin tekoälyä voi käyttää?
Tekoäly hoitaa jo monia arkisia asioita, usein ihan huomaamatta:
- Puheavustajat. Siri ja Googlen Gemini tunnistavat puhutun kielen ja vastaavat siihen. Puheavustajien taustalla toimivat nykyään yhä useammin samanlaiset suuret kielimallit kuin keskustelupalveluissa.
- Chatbotit. Verkkokauppojen ja pankkien asiakaspalvelubotit vastaavat yleisimpiin kysymyksiin ilman ihmistä yhdistelemällä sääntöpohjaista logiikkaa ja kielimalleja.
- Suositusalgoritmit. Netflixin sarjavinkit, Spotifyn soittolistat ja verkkokaupan ”saatat pitää myös näistä” -listat perustuvat siihen, mitä samanlaisen maun käyttäjät ovat aiemmin valinneet.
- Kuvantunnistus. Puhelimen kamera tunnistaa kasvot ja tekstin, ja moni valokuvapalvelu osaa lajitella kuvia automaattisesti aiheen mukaan.
- Tekstin ja koodin tuottaminen. Yhä useampi kirjoittaa sähköposteja, tarjouksia tai koodia tekoälyn avulla: kone tekee ensimmäisen luonnoksen ja ihminen viimeistelee sen.
Tämäkin sivusto on esimerkki viimeisestä kohdasta. Se on rakennettu ohjaamalla ja promptaamalla tekoälyagentteja. Hakusana- ja kilpailija-analyysissä tekoäly kokosi datan, ja minä tulkitsin sen ja päätin, mitä sillä tehdään. Tekoälyn hyvä käyttö on ennen kaikkea sitä, että osaat ohjata konetta oikeaan suuntaan.
Ilmaiset ja suomenkieliset tekoälypalvelut
Moni jättää tekoälyn kokeilematta, koska luulee, että siihen tarvitaan maksullinen tilaus tai hyvä englannin kielen taito. Kumpikaan ei pidä paikkaansa.
ChatGPT:n hinnoittelu perustuu niin sanottuun freemium-malliin: perusversio on ilmainen osoitteessa chatgpt.com, ja maksullisissa tilauksissa on enemmän ominaisuuksia. ChatGPT:ltä voi kysyä suoraan suomeksi, ja se vastaa sujuvasti samalla kielellä. Sama pätee useimpiin muihinkin tekoälypalveluihin: niiden taustalla olevat suuret kielimallit on koulutettu monikielisellä aineistolla, vaikka englanninkielistä materiaalia on tietysti eniten.
Mikä on paras tai kehittynein tekoäly?
Paras tai kehittynein tekoäly riippuu tehtävästä, ja järjestys muuttuu nopeasti. Lisäksi sama malli voi toimia monessa sovelluksessa ja sama sovellus voi vaihtaa malliaan, joten paras malli ja paras sovellus omaan tehtävääsi eivät ole sama asia. Myös sovelluksen työkalut, kuten verkkohaku ja tiedostojen käsittely, vaikuttavat lopputulokseen.
Kokeile siis samaa tehtävää omasta työstäsi muutamassa palvelussa, esimerkiksi ChatGPT:ssä, Claudessa, Copilotissa ja Geminissä, ja katso, mikä niistä sopii sinulle parhaiten.
Mitä ei kannata kysyä tekoälyltä?
Tekoälyltä voi kysyä melkein mitä tahansa, mutta kaikkiin vastauksiin ei kannata nojata. Kokemukseni mukaan näissä asioissa kannattaa olla tarkkana:
- Luottamuksellinen tieto. Älä syötä asiakkaiden henkilötietoja, salasanoja tai yrityksen luottamuksellisia tietoja palveluun, jota organisaatiosi ei ole hyväksynyt käyttöön.
- Tuoreet faktat ilman hakua. Jos sovellus ei tee verkkohakua, kielimalli vastaa koulutusdatansa varassa. Hinnat, aikataulut ja uutiset voivat olla vanhentuneita.
- Asiat, joiden oikeellisuutta et pysty tarkistamaan. Terveys-, laki- ja raha-asioissa tekoäly auttaa jäsentämään kysymyksen, mutta päätöksen pohjaksi tarvitset luotettavan lähteen tai asiantuntijan.
- Tarkat laskelmat ilman tarkistusta. Kielimalli itse ennustaa tekstiä eikä laske kuin laskin. Jos sovellus laskee koodin avulla, tulos on yleensä luotettavampi, mutta tärkeät luvut kannattaa silti tarkistaa.
- Valmis päätös puolestasi. Omassa käytössäni tekoäly on hyödyllisimmillään, kun se tuo esiin vaihtoehtoja ja perusteluja – päätöksen teen itse.
Moni huono vastaus syntyy epäselvästä kysymyksestä. Ohjeet parempaan kysymiseen löydät oppaasta Promptaus ja prompti.
Mitä haittaa on tekoälystä?
Tekoälyllä on rajansa, ja rehellisyyden nimissä ne kannattaa sanoa ääneen.
Kielimallit voivat tuottaa väärää tietoa hyvin varmalta kuulostavalla tavalla. Ilmiötä kutsutaan hallusinoinniksi. Malli ei valehtele tietoisesti, koska sillä ei ole käsitystä totuudesta: se ennustaa todennäköisintä seuraavaa sanaa, ja joskus ennuste osuu pieleen. Siksi tekoälyn tuottamat faktat, lähteet ja laskelmat kannattaa aina tarkistaa, varsinkin jos niitä käytetään päätöksenteon tukena.
Toinen haaste liittyy dataan, jolla mallit on koulutettu: jos aineistossa on vinoumia, ne voivat kulkeutua myös mallin vastauksiin. Tekoälyyn liittyy myös tietosuoja- ja tekijänoikeuskysymyksiä, jotka ovat vielä osin ratkaisematta.
Arjessa näkyy myös hiljaisempi haitta. Kun kielimalli kirjoittaa ensimmäisen version, sen virheet ja painotukset jäävät helposti lopulliseen tekstiin, jos kukaan ei pysähdy miettimään. Uskon, että tekoäly on työkalu, ei ajattelun korvike. Siksi opetan käyttämään tekoälyä niin, että päätökset pysyvät sinulla.
Joskus tekoälyä ei kannata käyttää lainkaan. Jos vastauksen tarkistaminen vie enemmän aikaa kuin tehtävän tekeminen itse, hyöty katoaa. Toistuvat tehtävät, joissa sääntö on selvä, hoitaa varmemmin tavallinen ohjelma tai skripti. Oma nyrkkisääntöni agenttien kanssa: agentti löytää ratkaisun, skripti toistaa sen.
Tekoälyn historia lyhyesti
Tekoäly ei ole mikään uusi ilmiö, vaikka viime vuosien julkisuus voisi antaa toisen kuvan. Tarkat vuosiluvut alla perustuvat suomenkielisen Wikipedian artikkeleihin Tekoäly, Deep Blue ja ChatGPT.
- 1950 – Alan Turing esitti artikkelissaan Turingin testin koneiden älykkyyden arvioimiseksi.
- 1956 – Englanninkielinen termi artificial intelligence (tekoäly) otettiin käyttöön Dartmouthin konferenssin yhteydessä. Konferenssia pidetään alan varsinaisena lähtökohtana.
- 1960–1980-luvut – Ensimmäiset asiantuntijajärjestelmät ja sääntöpohjaiset ohjelmat. Vuonna 1973 Lighthillin raportti kritisoi alan edistymättömyyttä, rahoitus väheni ja alkoi ensimmäinen niin sanottu tekoälytalvi.
- 1990–2000-luvut – Koneoppimisen menetelmät yleistyivät laskentatehon kasvaessa. Vuonna 1997 IBM:n Deep Blue -tietokone voitti shakin hallitsevan maailmanmestarin Garri Kasparovin.
- 2010-luku – Syväoppiminen teki läpimurron kuvantunnistuksessa ja puheentunnistuksessa, kun aineistoa ja laskentatehoa oli vihdoin riittävästi.
- 2022 – ChatGPT julkaistiin 30. marraskuuta, ja generatiivinen tekoäly siirtyi suuren yleisön käyttöön ja arkipuheeseen.
Kehitys ei ole pysähtynyt, ja mallit vaihtuvat tiheään tahtiin. Siksi en nimeä tässä oppaassa mitään ”kehittyneintä” mallia. Tekoälyn perusteiden ymmärtäminen kantaa pidemmälle kuin yksittäisen palvelun ulkoa opettelu, ja sen varassa uudetkin versiot on paljon helpompi omaksua.
UKK
Onko AI sama kuin tekoäly?
Kyllä. AI on englanninkielisen termin artificial intelligence lyhenne, ja tekoäly on sen suomenkielinen vastine. Ne tarkoittavat samaa asiaa, ja niitä käytetään suomessa usein rinnakkain, jopa samassa lauseessa. Joskus näkee myös sanan keinoäly, mutta vakiintunut nimitys on tekoäly.
Onko ChatGPT tekoäly?
Kyllä. ChatGPT (myös Chat GPT) on OpenAI:n generatiivisen tekoälyn palvelu. Vastaukset tuottaa kielimalli, ja ChatGPT-sovellus välittää keskustelun mallille ja antaa sille käyttöön työkaluja, kuten verkkohaun. Arkipuheessa ChatGPT tarkoittaa usein kumpaakin, mutta malli ja sovellus ovat eri osia.
Mikä on paras ilmainen tekoäly?
Yhtä parasta ei ole, koska mallit kehittyvät nopeasti ja järjestys vaihtelee tehtävän mukaan. Ilmaisversio löytyy esimerkiksi ChatGPT:stä, ja se toimii myös suomeksi. Anna parille palvelulle sama tehtävä omasta työstäsi ja valitse se, jonka vastauksia joudut korjaamaan vähiten.
Mikä on yleinen tekoäly (AGI)?
Yleinen tekoäly eli AGI (artificial general intelligence) tarkoittaisi järjestelmää, joka pystyisi oppimaan ja soveltamaan osaamistaan yhtä laaja-alaisesti kuin ihminen. Nykyiset kielimallit suoriutuvat jo monenlaisista tehtävistä, mutta niiden osaaminen on epätasaista, eivätkä ne yllä ihmisen joustavaan oppimiseen ja päättelyyn. AGI on toistaiseksi tavoite, ei olemassa oleva tuote. Siitä, milloin se saavutetaan, ei ole yksimielisyyttä.
Onko Siri tekoäly?
Kyllä. Siri tunnistaa puhetta ja suorittaa komentoja koneoppimisen avulla. Alun perin se oli komentoihin keskittyvä puheavustaja, mutta nykyään se voi välittää kysymyksiä ChatGPT:lle, ja Apple on tuonut sen taustalle myös suuren kielimallin. Ero ChatGPT:n kaltaisiin keskustelupalveluihin on siis kaventunut.
Onko tekoäly aina oikeassa?
Ei. Kielimallit eivät tiedä, mikä on totta – ne ennustavat todennäköisintä vastausta koulutusdatastaan oppimansa perusteella, ja joskus ennuste osuu pieleen. Tekoälyn tuottamat väitteet, luvut ja lähteet kannattaa siksi aina tarkistaa itse, varsinkin töissä tai päätöksenteossa.
Onko tekoäly turvallinen?
Tekoäly on niin turvallinen kuin sen käyttötapa. Riskit riippuvat siitä, mitä tietoja sille annat ja mitä oikeuksia tekoälysovellus saa: pelkkä keskustelu on eri asia kuin sovellus, joka lukee sähköpostisi tai lähettää viestejä puolestasi. Älä syötä henkilötietoja tai luottamuksellista tietoa palveluun, jota organisaatiosi ei ole hyväksynyt, ja tarkista vastaukset ennen kuin toimit niiden pohjalta.
Mistä liikkeelle omassa työssä?
Jos haluat käydä teorian läpi kurssimuodossa, Helsingin yliopiston ja MinnaLearnin ilmainen Elements of AI -verkkokurssi on hyvä paikka aloittaa. Oma oivallus syntyy kuitenkin yleensä vasta silloin, kun pääsee kokeilemaan tekoälyä omassa työssä, omilla esimerkeillä. Siihen tekoälykoulutukseni on rakennettu: käydään ensin perusteet läpi ilman jargonia, katsotaan sitten yhdessä sinun arkeasi ja mietitään, mihin tekoäly siinä oikeasti sopisi – ja mihin ei. Koulutuksen päätteeksi mukaan jää jotain konkreettista: valmis prompti, työnkulku tai suunnitelma, jota voi käyttää heti seuraavana työpäivänä.
Koulutan 5–12 hengen ryhmiä. Workshopit pidetään paikan päällä pääkaupunkiseudulla, lyhyet koulutukset myös etänä tai hybridinä. Yhdistyksille ja järjestöille on oma koulutuksensa ja hinnoittelunsa, ja kaikki hinnat löydät hinnastosta.
Haluatko oppia tämän käytännössä, ei vain teoriana?
AI-Koulutukset järjestää käytännönläheisiä tekoälyworkshopeja 5–12 hengen ryhmille pääkaupunkiseudulla. Ei kalvosulkeisia: harjoittelet omilla työtehtävilläsi, ja mukaan lähtee jotain konkreettista.