Tekoälystä

15. syyskuuta 2026

On aika ennen ChatGPT:tä ja aika sen jälkeen. OpenAI julkaisi ChatGPT:n julkiseen käyttöön 30. marraskuuta 2022 ja saavutti alle viikossa miljoona käyttäjää. Reilussa kuukaudessa käyttäjiä oli sata miljoonaa ja nykypäivänä luku on lähellä miljardia. Ensimmäinen kaikille julkaistu versio oli 3.5 ja tätä ennen olivat tulleet versiot 1.0, 2.0 ja 3.0. Ne olivat lähinnä sisäiseen tarkoitukseen olleita kehitysversiota. OpenAI laski sen varaan, että syöttämällä aiemmin kehitetyille tekoälymalliratkaisulle enemmän koulutusdataa, tulisi mallista todella hyvä. Google oli julkaissut vuonna 2017 artikkelin, jonka pohjalta OpenAI lähti kehittämään omia parannuksiaan Googlen ratkaisuun. OpenAI julkaisi oman tutkimusartikkelinsa 2018, missä he argumentoivat oman GPT-mallinsa puolesta. GPT-1 handlasi 117 miljoonaa parametriä (yksikkö, jota käytetään kuvaamaan AI:n laajuutta).

GPT-2 koulutettiin 8 miljoonalla webbisivulla ja se handlasi 1,5 miljardia parametriä, muttei vieläkään räjäyttänyt pankkia vaikka oli huomattava parannus ensimmäiseen malliin nähden. Mallin koulutus söi laskentatehoa 43 tuhannen dollarin edestä. Ei siis aivan hirveästi vielä tässä välissä, mutta kertoi siitä, että yhden koodarin startupilla ei enää olisi varaa lähteä rakentamaan tällaista tyhjästä. Massia tarvittaisiin jo pelkän sähkölaskun maksamiseen niin paljon, että sijoittajia olisi pakko hankkia.

GPT-3 handlasi jo 175 miljardia parametriä ja koulutuskustannuskin alkoi pyöriä jo miljoonissa. Malli olikin sitten huomattavan hyvä. OpenAI:n ajatus siitä, että syöttämällä valtavasti koulutusdataa mallille, saataisiin siitä hyvä, näytti toimivan oikein hyvin.

GPT-4 oli ensimmäinen malli, jota sai aluksi rahaa vastaan ja sen koulutukseen oli käytetty jo yli sata miljoonaa dollaria – lähinnä sähkölaskua maksellen. Parametrejä mallissa oli yli biljoona. Tässä vaiheessa skaalautuvuus ei enää tuonutkaan samanlaista hyötyä, ja vaikka GPT-4 oli selkeästi markkinajohtaja ilmestyessään, toivat kilpailijat myös omia mallejaan jo tarjolle ja kilpailuvalttia ruvettiin hakemaan muilla keinoilla kuin vain syöttämällä enemmän koulutusdataa ja lyömällä enemmän parametrejä malleille.

Ja sitten olemmekin jo vaudikkaasti ajassa, jossa miljoonat ihmiset käyttävät tekoälyratkaisuja päivittäin. Tekoälyllä generoidaan hassuja kuvia, mainoksia, musiikkia, ohjelmakoodia, puheita, taidetta, videoita – ihan mitä mieleen juolahtaa. Haluatko kuvan perheestäsi 1700-luvulla? Anna vastikään otettu kuva ja pyydä (tai käske) tekoälyä muokkaamaan se näyttämään 1700-luvun aateliselta. Tuntuuko, että haluaisit trancebiisin, joka kertoo Mäntsälästä? Promptaa se itsellesi muutamassa minuutissa. Puuttuuko sotaministeriltäsi logo? Sen saat kädenkäänteessä tekoälyltä.

Elämme siis aikaa, jossa markkinapuheiden mukaan tekoäly tehostaa elämäämme koko ajan. Näin koodarina voinkin kyllä todeta, että AI-kaveri on mukava apu debuggaamaan koodia. Samoin saan peliini kätevästi taustamusiikit, vaikken osaa itse säveltää nuottiakaan. Kolikolla on kuitenkin kääntöpuolensa, joka on varsin moninainen.

Aloitetaan jo mainituista sähkölaskuista. Lähes kaikki tekoälyfirmat pyörittävät bisnestään tappiolla. Ne haluavat olla voittajia ja nostaa sen jälkeen taksat vastaamaan kustannuksia – tai jos sattuisivat keksimään ratkaisun, joka kuluttaa vähemmän energiaa. Ihmiset tulee saada koukutettua palveluun niin kovasti, että kustannuksia voidaan nostaa, eivätkä käyttäjät enää pärjää ilman vieressä koodaavaa tekoälyagenttia tai silmänpohjakuvia tutkivaa lääkäri-AI:ta.

Tällä hetkellä rakennetaan uusia datakeskuksia pilvin pimein. Ne haukkaavat sähköä isosti ja kun sähköä tarvitaan nopeasti lisää, sitä tuotetaan helposti fossiilisilla. Datakeskus on pystyssä viikoissa ja ydinvoimalan rakentaminen viereen vie 10 vuotta, mutta kaasuturbiinivoimala voidaan kuskata paikalle varsin nopeasti. Maakaasun polttamisesta aiheutuvat haitat lähiseudulle jäävät sitten siellä asuvien ihmisten murheeksi, eivät tekoälyfirman.

Suomessa ja muissa Pohjoismaissa on toki erittäin hiilivapaata sähköä ja viileää säätä, joten tänne on hyvä rakentaa datakeskuksia. Se on oikeasti ympäristöteko verrattuna niiden rakentamiseen Teksasiin tai Puolaan. Ongelmatonta se ei kuitenkaan ole. Lisääntyneen sähkönkulutuksen maksaa joku, enkä ole aivan varma, että se lasku menee näille datakeskusfirmoille. Tämä päätös on poliittinen.

Sivuhuomautuksena, vaikkei Suomeen tulisi yhtään datakeskusta lisää, tulee meidän silti vähintään tuplata sähkötuotantomme – todennäköisesti kolminkertaistaa, jotta pystymme omavaraisina yhteiskunnan sähköistyessä. Käyttämästämme primäärienergiasta yli puolet syntyy polttamalla jotakin (öljyä, hiiltä, puuta, päreitä) ja tämä synnyttää hiilidioksidipäästöjä.

Siinä missä energiantuotantomme on hyvin kotimaisissa käsissä (ja myös riippuvainen globaaleista öljymarkkinoista ja uraanin saamisesta), on tekoälymarkkina tällä erää yhdysvaltalaisten ja kiinalaisten yritysten temmellyskenttä. Eurooppalaiset mallit ovat aivan marginaalissa. Jos Kiinan valtio päättää, että Tiananmenin aukion tapahtumista ei puhuta, ei kiinalainen tekoäly sitten siitä puhu. Jos Musk päättää, että hän on maailman napa, on Grok sitten sitä mieltä. Historian väärentäminen ei ole ollut koskaan niin helppoa kuin nyt.

Tekoälymallit sisältävät vain bittejä – ainakin tekijöidensä mukaan. Niistä ei siis pitäisi pystyä kaivamaan ulos esimerkiksi mitään jo luotua artistista teosta. Kuitenkin tutkijat ovat onnistuneet kirjoittamaan 96% Harry Potterista pelkän tekoälyn avulla. Tekoälyllä luodut markkinointimateriaalit ovat pois graafisen suunnittelijan työstä – ja samalla palkasta. Koodarille ei enää ole töitä, kun AI-agentti hoitaa hommat. Musiikin tekijän ei tarvitse enää osata soittaa eikä laulaa, sillä tekoäly hoitaa koko homman – tarvittaessa sanoittaa myös koko biisin, joten sinun tarvitsee vain pyytää haluamasi kaltainen laulu. Kuulostanko luddiitilta?

Tämä on varsin mielenkiintoista kehitystä. Jäänkö minä ohjelmoinnin opettajana työttömäksi, kun meitä koodareita ei enää tulevaisuudessa tarvitakaan? Tätä olen nyt miettinyt ensimmäisen kerran vuonna 2026. Aika näyttää miten käy. Toisaalta esimerkiksi pelaajien keskuudessa ei arvosteta pelejä, joissa on esimerkiksi tekoälyllä generoitua grafiikkaa. Ehkä näemmä tulevaisuudessa peleissä luomuleiman? "Tämä peli on 100% ihmisten tekemää!"

Jos ajattelen musiikin tekemistä, niin onhan tässä kaikenlaista tapahtunut. Muusikon ei ole enää vuosikymmeniin tarvinnut osata soittaa mitään soitinta, sillä musiikinteko-ohjelmistot ovat tarjonneet sampleja erilaisista soittimista ja myös digitaalisia versiota näistä pilvin pimein. Musiikin tekeminen on vahvasti ollut tietokoneen ääressä istumista, ei nuottien kirjoittamista ja viulunsoiton opettelua. Tekoäly vie tätä askeleen pidemmälle – joskin sillä erotuksella, että koulutusmateriaalien ei-vapaaehtoisille tarjoajille, ei makseta mitään.

Tämä avaa myös monia ovia huijaamiselle. Akateemisessa maailmassa liian monet opiskelijat palauttavat tehtäviä, jotka on tehnyt tekoäly osin tai kokonaan. Opettajat lukevat sitten niitä tai laittavat tekoälyn arvostelemaan työt. Olemme palanneet monessa suhteen taaksepäin opetusmetodeissa, sillä joudumme vaatimaan kursseilla tenttejä, jotka tehdään perinteisesti ilman pääsyä internetiin. On lukuisia tutkimuksia, joissa kerrotaan kuinka opiskelijat saavat viikkotehtävistä täysiä pisteitä, mutteivät osaa tentissä yhtään mitään.

Tämä vaikuttaa myös kaikkeen työhön, jota teemme. Koodari voi antaa oma ohjelmointitaitonsa rapautua, sillä kone hoitaa hommat. Lääkärin diagnosikyky heikkenee, kun kone hoitaa diagnoosit. Kielitaito rapistuu, kun kone kääntää sisällön jo valmiiksi ymmärretylle kielelle. Emme enää jaksa painia suurten datamassojen kanssa (esim. 3 sivun artikkeli Suomen kuvalehdessä), sillä tekoäly voi koostaa meille siitä kahden lauseen yhteenvedon. Oppiminen ylipäätään on tämän hetkisten tukimusten mukaan tehokkaampaa ilman tekoälyä, kuin vain lukemalla, mitä tekoäly meille tarjoaa. Aivojen itsensä muodostamat yhteenvedot opettavat meitä enemmän kuin tekoälyn tekemät. Oman neuroverkon kouluttaminen korvien välissä on hyödyllisempää kuin OpenAI:n neuroverkon käyttö.

Jos somen räjähdysmäinen käyttö ei tehnyt nuorisomme Pisa-tuloksille hyvää, kannattaa ehkä kysyä, mitä tekoälyn käyttö tekee niille?

Tekoälyä voidaan käyttää myös esimerkiksi ihmisterapeutin korviikkeena ja joillekin se voi olla elämän pelastava asia. Toisille sitten taas ei. Ihmiset ovat erilaisia. Nyt tekoäly on kuitenkin jo vastuussa useammasta kuolemantuottamuksesta – jopa itsemurhaan kannustamisesta. Tällaisia asioita kukaan ei halunnut, kun laajoja kielimalleja ruvettiin kehittämään, mutta tällaiseen maailmaan olemme kuitenkin päätyneet.

Teemme ihmiskunnan suurinta ihmiskoetta ilman, että tähän on haettu minkäänlaista lupaa miltään eettiseltä komitealta.

Palataan vielä lopuksi termiin tekoäly. Onko se älyä? Kyllä ja ei. Jutellessasi tekoälyn kanssa on välillä vaikea hahmottaa, ettei ruudun toisella puolen ole ketään ihmistä. Siellä on vain todennäköisyyslaskentaa. Jos mitä kirjoitan ruudulle "moi", kannattaa tekoälyn vastata siihen "hei" 63,2 prosentin todennäköisyydellä. Tätä ajatusta on nyt skaalattu ylös isosti. Jotkut ovat jo sitä mieltä, että olemme saavuttaneet yleisen tekoälyn tason, mutta itse en siihen kuulu. Enkä näe, että LLM voisi koskaan olla yksinään tekniikka, jossa tekoäly saisi samat kognitiiviset kyvyt kuin ihminen, mutta se on varmasti osa sitä prosessia, jolla rakennamme entistä paremman tekoälyn ja mahdollisesti saavutamme singulariteetin. Onko se sitten tavoiteltava asia? Itse haluaisin ajatella ettei. Pidän ajatuksesta, jossa me ihmiset olemme älykkäimpiä tuntemiamme olentoja.

Todettakoon vielä, että tekoäly on meillä nyt käytössä, eikä henkeä pysty enää tunkemaan takaisin pulloon. Ongelmia on edessä varmasti paljon, mutta ehkä hyödyt kuitenkin ylittävät haitat? Ehkä.

Kommentti

Tämän kentän sisältö pidetään yksityisenä eikä sitä näytetä julkisesti.

Puhdas teksti

  • HTML-merkit ovat kiellettyjä.
  • Rivit ja kappaleet päätetään automaattisesti.
  • Verkko- ja sähköpostiosoitteet muutetaan automaattisesti linkeiksi.