Avainsana: tekoäly

  • Sanaston synty (Osa 8)

    Sanaston synty (Osa 8)

    Tämä kesäprojekti alkaa olla loppusuoralla ja juttusarjakin jo kahdeksannessa osassa. Hyvää asiaa on silti vielä jäljellä. Tällä kertaa kokoan yhteen arvoja ja periaatteita, joiden varaan tätä hanketta on rakennettu. Äänessä on nyt esseisti, mutta paikalla oleva tekninen dokumentoija palauttaa välillä puheen käytännön tasolle.


    Arvot kaiken takana

    Arvoista puhuminen tuntuu usein vähän juhlalliselta ja poseeraamiselta, Niiden kautta kuitenkin näkee, mitkä ovat yleiset tavoitteet ja millaisilla keinoilla niihin halutaan päästä. Niistä puhutaan harvoin arjessa, mutta yritän tehdä nyt juuri sitä.

    Avoimuus on aina hyvä periaate. En lähtenyt kokoamaan valmista sanakirjaa, enkä digitaalista oppimissovellusta, vaan tutkimaan, voisiko kehittää menetelmän, jolla sanastoja voisi luoda ihan itse. Halusin, ettei menetelmä jäisi yhden ihmisen tai yhden palvelun varaan, joten halusin julkaista tuotokset vapaasti käytettäväksi. Sanastoja kun tarvitsevat kaikki kieltä opiskelevat ja opettavat. Tuskinpa tekoälylle annettavaa kehotetta voisi edes suojatakaan, joten yritin lähteä tekemään ratkaisua, jonka jokainen voisi ottaa käyttöönsä helposti, ilmaiseksi ja laillisesti.

    Toimijuus on luonteva jatko edelliselle. Kun oppija voi luoda itselleen oppimateriaalin aiheesta, joka häntä aidosti kiinnostaa, esim. japanilaisesta ruokareseptistä, hän on heti motivoituneempi opiskelemaan juuri hänelle räätälöityä sanastosisältöä. Musiikkifani voi etsiä netistä suosikkibändinsä uutuussinglen sanoitukset ja opetella sen sanat heti, kun kappale on julkaistu. Käyttämällä GGS:n kaltaista työkalua oppija voi ilman syvällistä tekoälyosaamista valita itse, mitä opiskelee. Tuolloin hän ei ole pelkkä oppimateriaalin kuluttaja, vaan hänestä tulee sen tuottaja. Samaa toimijuutta voi myös nähdä sanastojen luomisessa ajankohtaisista sisällöistä. Uutissähkeen antaminen sanastogeneraattorin lähdetekstiksi vahvistaa oppijan omaa toimijuutta yhteiskunnan aktiivisena jäsenenä.

    Sitoutumattomuus on myös yksi hankkeen kulmakivistä. En lähtenyt kehittämään ratkaisua millekään tietylle tekoälypalvelulle, en mitoittanut kapasiteettitarvetta niiden mukaan enkä käyttänyt niiden kehittyneitä ominaisuuksia, kuten agenttia, APIa tai koodi-ikkunaa. Tämä siksi, että tekoälyjen toiminnot muuttuvat jatkuvasti. Yleisiin perusominaisuuksiin tyytymällä työkalun elinkaari on varmasti pidempi.

    En ole testannut, kuinka laajoja lähdeaineistoja jonkun tietyn tekoälyn ilmainen tai maksullinen versio kestää, sillä järjestelmät rajoittavat käyttäjän toimintaa mm. hetkittäisen käyttäjämäärän ja järjestelmän kuormitusasteen mukaan. Tekoälyt eivät myöskään osaa tai niillä ei ole lupa itse kertoa kapasiteetin rajoituksistaan. Niihin törmää vasta kun tehtävän suorittaminen ei onnistu. Jos esimerkiksi antaisit GGS:lle kokonaisen kirjan lähdetekstiksi, tavallisen kotikäyttäjän ilmaiset chatbotit eivät siitä selviytyisi (kesällä 2026). Teknologia kehittyy, mutta sen nykyiset rajat löytää vain kokeilemalla itse.

    Muokattavuus on tärkeää. Jos työkalua voi itse muokata, sen saa paremmin vastaamaan omia tarpeita. Ihmiset myös oppivat eri tavoilla. Joku saattaa kaivata lyhyttä esimerkkilausetta, mistä voi opetella sanan käyttötapaa, miten se näkyy lauseen muodossa tai miten sitä on taivutettu. Tällaisen esimerkkilauseen lisääminen sanastoentryn speksiin ei ole edes vaikeaa. GGS:ä saa ja sitä voi vapaasti muokata.

    • Kaikki aineisto on julkaistu Creative Commons -lisenssillä BY 4.0.
    • Speksit ja tehtävän määritykset ovat selkeää englantia.
    • Speksitiedostot ovat normaaleja Word-muotoisia dokumentteja.
    • Lyhenteet on listattu ja niitä käytetään systemaattisesti.
    • Kryptisiä muuttujien nimiä ei ole käytetty. Lähes kaikki on toteutettu luonnollisella kielellä.

    Järjestelmä on rakennettu tuottamaan japaninkielisestä lähdetekstistä englanninkielisin selityksin varustettuja sanastoja. Pienillä muutoksilla sen saa tuottamaan esimerkiksi suomalaisin selityksin varustettuja sanastoja englanninkielisestä lähdetekstistä.


    Suunnitteluperiaatteita

    Heti alussa oli selvää, ettei sanastoja ja muita tuotoksia ollut mielekästä toteuttaa minkään tietyn verkkopalvelun varaan. Ei siis natiivisti blogiin, kyselytyökaluun tai oppimisalustalle, vaan jakelualustasta riippumattomaan ja siirrettävään muotoon. Yksinkertainen vaihtoehto tähän oli tehdä tuotokset tiedostopohjaisiksi.

    • Helppo viedä koulun käyttämälle oppimisalustalle
    • Helppo arkistoida kotikoneelle, matkapuhelimeen tai koulun palvelimelle
    • Tiedostot eivät saastu palvelutarjoajan mainoksista
    • Luettavuus on hyvä myös mobiililaitteilla ja linkit toimivat
    • docx- ja pdf-tiedostoja voi luoda ilman maksullisia ohjelmia tai verkkopalveluita
    • Opettaja voi helposti lähettää oppilaalle sanastotiedoston ja tehtävänannon
    • Näppärimmät oppilaat voivat luoda sanastoja itse ja lähettää niitä opettajalle

    Laadin GGS:n suoraan englanniksi, sillä ajattelin sen käyttäjiksi J-rock-fanit ja japanin itseopiskelijat ympäri maailmaa. Suomessa meitä on vähän, mutta maailmalla enemmän. Työkalua ei siis kannata sitoa vain yhdelle kielialueelle. Tämän lisäksi kielimallien käyttämä perustason luonnollinen kieli on englanti. Kun tekoälylle antaa ohjeet suoraan englanniksi, sen ei tarvitse ensin kääntää niitä suomesta.

    Tavoitteena oli aluksi laatia kehote, joka tuottaisi heti julkaisuvalmiin sanaston. Sellaisen, jota ei tarvitsisi ohjata eikä muotoilla manuaalisesti. Eipä käynyt aivan noin helposti. Heti ensimmäiset kokeilut osoittivat, että tekoälylle täytyy määritellä sanaston sisältö ja ulkoasu todella tarkasti. Jos tulkinnanvaraa jää, tekoäly tekee, miten parhaaksi näkee tai kyselee käyttäjältä tarkempia ohjeita.

    Parhaat opit

    Sanaston luominen ei olekaan kehotteessa annettava käsky, vaan enemmän määritystä, millainen sanaston pitää olla. Tämä oli kätevintä laatia erilliseen tiedostoon ja antaa kehotteen liitteenä. Hankkeen alkupuolen ongelmat keskittyivät juuri tämän GGS-määrityksen (Glossary Generation Specification) kehittämiseen, testaamiseen, vianetsintään ja tulkinnanvaraisuuden eliminoimiseen.

    Kokeilut opettivat, että on parempi tyytyä maksimaalisia tavoitteita vähempään, riittävään ja kohtuulliseen tulokseen. Tämä tuli vastaan monessa kohtaa:

    • Tekoälylle on parempi antaa yksi selkeä tehtävä ja kohdella sitä kuin työkalua, joka tekee yhden vaiheen isommasta kokonaisuudesta. Asioita ei ehkä kannata tehdä yhdellä jättikäskyllä alusta loppuun vaan tehtävät muodostavat työnkulun, prosessin tai tuotantoketjun.
    • Tekoälyn ohjauksessa oli tärkeä löytää tasapaino määritysten ja sääntöjen määrässä, tarkkuudessa ja ehdottomuudessa. Liian paljon, liian tarkkoja ja ehdottomia sääntöjä estää tehtävän suorittamisen. Toisaalta puuttuvat tai liian väljät säännöt tuottavat vaihtelevan laatuisia tuloksia.
    • Tekoäly menee helposti liian syvälle yksityiskohtiin. Yhdessä vaiheessa aiheettomia virheilmoituksia alkoi tulla esimerkiksi siitä, että sana voitiin tulkita kuuluvan kahteen eri sanaluokkaan. Esimerkiksi sana ”tulkinta” on sekä tekemistä (verbi) että tekemisen tuotos (substantiivi). Kohtuullisuus löytyi niin, että määriteltiin sanoille pehmeärajaiset luokitukset (esim. ”verbish”).

    Toisinaan tekoäly epäonnistui tehtävän suorittamisessa, kun se pyrki täyteen varmuuteen sanan selityksessä. Tämä korjattiin lopulta lisäämällä laatuperiaate: ”Kun täysi varmuus on mahdotonta, käytä todennäköisintä lingvististä analyysiä ennen kuin ohitat sanan tai keskeytät tehtävän suorittamisen.”

    Yksi japanilaisen estetiikan, yhteiskunnan ja päätöksenteon keskeisiä käsitteitä on wa (和). Se tarkoittaa mm. harmoniaa, rauhaa ja ryhmähenkeä. Sovelsin siitä käyttäjän ja tekoälyn tasapainoa kuvaavan termin AIwa (アイ和). Se kuvaa omien tavoitteiden sovittamista ilman konflikteja siihen, mikä on yleisesti mahdollista. Se on minusta realistinen ja käytännöllinen asenne, kun toimitaan tekoälyn kanssa.

    Tehdään, mitä voidaan sillä, mitä meillä on.

    AIwa näkyy ehkä parhaiten yhdessä projektin ratkaisevista keskusteluista. Liitän tähän transkription, jossa GGS:n ja GDV:n sääntöjä sovitetaan yhteen. Kieliopin yksityiskohtia tärkeämpää on nähdä, miten rakentava vuoropuhelu toimii kehittämisen välineenä.

    convo-2026-07-13.pdf (14 s. CC BY 4.0)


    Juttusarjan yhdeksännessä ja viimeisessä osassa on pieni kokeiluympäristö, minkä lisäksi puhutaan tekijänoikeuksista, hankkeen tuotoksista ja niiden jakelusta.

  • Sanaston synty (Osa 7)

    Sanaston synty (Osa 7)

    Tässä juttusarjan seitsemännessä osassa kerron kahdesta kätevästä työkalusta. PET (Phrase Extraction Tool) etsii lähdetekstistä fraaseja ja kääntää ne. GCC (Glossary Collection Compiler) kokoaa sanastoja yhteen. Hanke eteni hyvää tahtia, sillä nämä kaksi työkalua sekä tämä blogijuttu syntyivät käytännössä yhden päivän aikana.


    PET-fraasityökalu

    Fraasit ovat kielessä useamman sanan mittaisia merkkijonoja, joiden merkitys on eri kuin niiden osien summa. Japanissa kirjaimellisen ja kulttuurisen merkitysten ero voi olla niin suuri, ettei sanonta mitenkään avaudu tuijottamalla yksittäisiä sanoja. Seuraavassa esimerkki arkielämän fraasista:

    yoroshiku onegaishimasu (よろしくお願いします) 1. (literal) ”Please treat me favorably.” 2. (social) almost anything from ”Nice to meet you” or ”Please take care of this” to ”I look forward to working with you.

    Sanaston ja sanakirjan kannalta fraasit ovat hankalia. Tuodaanko ne sanastoon sana kerrallaan vai kokonaisuutena, aakkostetaanko ne fraasin ensimmäisen sanan vai ydinsanansa mukaan ja kuinka monta kulttuurista merkitystä voidaan tuoda mukaan. Erilaisissa sosiaalisissa tilanteissa fraasi voi merkitä erilaisia asioita, joten pitäisikö myös näitä tilanteita selittää sanastossa? Tällainen sosiaalinen tulkinta on hyvin mielenkiintoista, mutta myös aivan liian laaja aihe tähän juttuun. Se voisi olla kokonaisen juttusarjan aihe.

    Aiemmin kehitetyn GGS-sanastogeneraattorin käskettiin ohittaa lähdetekstissä olevat fraasit ja listata ne sanaston loppuun. Tuolloin päätettiin tehdä oma työkalu fraasien etsimiseen ja kääntämiseen. Fraasit opetellaan kokonaisuuksina, joten on hyvä, että ne voi lukea ja ymmärtää myös niin.

    PET (Phrase Extraction Tool) on fraasien tunnistustyökalu, joka löytyy alla olevasta linkistä. Se on melko yksinkertainen ja ensimmäiseen versioon on tullut vain pientä hienosäätöä. Se on edelleen kehitysversio, mutta toimii vakaasti ja tuottaa kielen opiskeluun hyvin hyödyllistä materiaalia.

    PET-013 (docx, 2 s. versio 0.13, CC BY 4.0, 2026-08-11)


    Fraasisanaston luominen

    1. Ota esiin chatbotti
    2. Lataa kehotteen liitteiksi SD ja PET -tiedostot
    3. Kirjoita kehotteeksi ”etsi fraasit sd-tiedostosta noudattaen tarkasti pet-speksiä. priorisoi laatu. unohda tehtävään käytettävä aika” ja paina Enter
    4. Jos kaikki menee hyvin, näytölle tulostuu valmis sanasto
    5. Tallenna tiedosto ja lisää sen nimeen koodi PGD (Phrase Glossary Document)

    Tässä pari esimerkkiä julkaisukelpoisiksi muotoilluista fraasilistoista:


    GCC-kokoelmatyökalu

    GCC (Glossary Collection Compiler) on työkalu, mikä kokoaa yksittäiset sanastot isommaksi kokoelmaksi Yhdessä tiedostossa ja aakkosjärjestyksessä se muistuttaa jo sanakirjaa. Työkalu on yksinkertainen ja hyvin toimiva. Sekin on julkaistu kehitysversiona.

    GCC-013 (docx, 2 s. versio 0.13, CC BY 4.0 2026-08-11)

    GCC suorittaa käytännössä seuraavat tehtävät:

    • lukee sanastoja ja sanastokokoelmia
    • laatii niistä lähdeluettelon
    • kokoaa sanastot yhteen
    • järjestää ne aakkosjärjestykseen
    • ei ota samaa sanaa kahta kertaa
    • lisää lähdeluettelomerkinnän, missä sanastoissa sana esiintyi
    • tulostaa sanaston yhtenä kokonaisuutena
    • listaa lopuksi ehdokkaiden, ohitettujen ja hyväksyttyjen sanojen määrät

    Sanastokokoelman luominen

    1. Ota esiin chatbotti
    2. Lataa kehotteen liitteiksi GCC-työkalu sekä GD-tai VGD -sanastot
    3. Kirjoita kehotteeksi esim. ”kokoa gd- ja vgd-tiedostoista sanastokokoelma noudattaen tarkasti gcc-speksiä. Priorisoi laatu. Unohda käytettävä aika.” ja paina Enter
    4. Jos kaikki menee hyvin, näytölle tulostuu valmis sanasto
    5. Tallenna tiedosto ja lisää sen nimeen GCD-lyhenne (Glossary Collection Document)

    Vinkkejä tiedonhallintaan

    Jos innostut sanastojen tekemiseen, niitä alkaa kertyä nopeasti paljon. Parhaat vinkit asioiden pitämiseen hallussa.

    1. Nimeä tiedostot huolellisesti
      Esim. [laulun_nimi]-[dokumenttikoodi]
    2. Tallenna kaikki luomasi tiedostot
    3. Tallenna kaikki samaan hakemistoon
    4. Älä muuttele tiedostonnimiä jälkikäteen
    5. Älä luota tekoälyn tiedostopuskuriin arkistona

    Juttusarjan seuraavassa, eli kahdeksannessa osassa puhutaan sanastohankkeen suunnitteluperiaatteista ja etenkin siitä, miten ne muuttuivat kehitystyön aikana. Oppilaitosmaailman edustajana olen luonnollisesti sitä mieltä, että jos hankkeessa ei mikään muutu, siinä ei myöskään paljoa opita. Seuraava osa tulee aivan pian.

  • Sanaston synty (Osa 5)

    Sanaston synty (Osa 5)

    Tässä viidennessä osassa päästään viimein käytäntöön ja jutun sävy muuttuu kerralla käyttöoppaaksi: miten sanastoja luodaan ja miten tiedonhallinta ei heti karkaa käsistä.

    Kun halutaan laatia juuri tietynlainen sanasto, tekoälylle on annettava tarkat ohjeet, miten sanasto tehdään, miltä valmiin sanaston pitää sisältää ja miltä se näyttää ulkoasultaan. Tällainen määritys on siksi monimutkainen, ettei sitä ole järkevää kopioida kehotteeseen, vaan antaa tekoälylle valmiina tiedostona. Se sisältää ohjeita, sääntöjä ja tehtäviä ja onkin enemmän spesifikaatio kuin kehote. Siitä se sai myös nimensä GGS (Glossary Generation Specification). Tämä speksi on julkaistu edelleenkin kehitysversiona, mutta se toimii jo hyvin vakaasti ja nopeasti. 

    GGS-097 (docx, 3 s, versio 0.97, CC BY 4.0, 2026-08-11)


    Näin luot sanaston

    Projektin periaatteena on olla sitoutumatta mihinkään tiettyyn tekoälyyn tai ohjelmistokohtaisiin edistyneisiin ominaisuuksiin. Tästä syystä seuraavat ohjeet eivät anna tarkkoja ”paina tuosta” -tyyppisiä ohjeita eri valmistajien tekoälypalveluille.

    1. Etsi lähdeteksti netistä ja kopioi se leikepöydälle
    2. Ota esiin tekstieditori, liitä lähdeteksti asiakirjaan ja tallenna se tiedostoksi.
    3. Lisää tiedoston nimeen SD-lyhenne (Source Document)
    4. Ota esiin chatbotti
    5. Lataa kehotteeseen SD ja GGS -tiedostot
    6. Kirjoita kehotteeksi ”luo sanasto SD-tiedostosta noudattaen tarkasti GGS-speksiä” ja paina Enter
    7. Jos kaikki menee hyvin, näytölle tulostuu valmis sanasto
    8. Kopioi sanasto tekstieditoriin ja tallenna se tiedostoksi
      (joistain chatboteista tulostuksen voi viedä suoraan tiedostoon)
    9. Lisää tiedoston nimeen GD-lyhenne (Glossary Document)

    Ulkoasun viimeistely

    Kun sanastoja alkaa kertyä enemmän, yhtenäinen ulkoasu helpottaa niiden yhdistämistä kokoelmiksi. Itse käytän Segoe UI -fonttia, ykkösen riviväliä sekä korostan selitettävän sanan lihavoinnilla ja sanaluokan kursivoinnilla. Dokumentin alkuun lisään otsikon, linkin, päivämäärän, lisenssitiedot sekä käytetyn GGS-version. Lisää muotoiluasetuksista tulee erilliseen GGM-oppaaseen(Glossary Generation Manual).

    Esimerkki valmiiksi muotoillusta sanastosta: ReoNa: ANIMA (pdf, 2 s. CC BY 4.0, EN)

    Dokumentin alkuun lisään otsikon, lähteen, päivämäärän, käyttöoikeustiedot sekä käytetyn GGS-version. Tarkemmat muotoiluasetukset löytyvät erillisestä GGM-dokumentista (Glossary Generation Manual). Tässä yksi esimerkki valmiiksi muotoillusta sanastosta:

    ReoNa: ANIMA (pdf, 2 s. CC BY 4.0, EN)


    Muista metadata

    Lisää sanastotiedostoon metadata jo tekstieditorissa. Tällöin PDF-vienti poimii ne mukaan automaattisesti, otsikko näkyy oikein myös intrassa ja metadataa voi käyttää hakusanoina.

    • Otsikko: mikä sanasto tämä on
    • Tekijä: Oma nimesi, jos haluat sen julkaista
    • Asiasanat: sanasto, japani, tekoäly tms.
    • Kommentti: GGS ja sen versio

    Jos haluat ilmoittaa olevasi GD:n tekijä, lisää oma nimesi sen metatietoihin tai sanaston alkuun. Jos et halua ilmoittautua tekijäksi, lisää Tekijä-kenttään GGS [versio].

    • Wordin sovellusversion metadatakentät löytää valitsemalla Tiedosto > Tiedot.
    • LibreOfficessa metadataa pääsee syöttämään valitsemalla Tiedosto > Ominaisuudet.

    Vinkit tiedonhallintaan

    Sanastot kannattaa tehdä alusta alkaen niin kuin niitä alkaisi tuottaa massoittain. Tiedostojen ja tekoälyn kanssa puuhatessa systemaattisuus on välttämätöntä, kun aletaan käyttää näitä uusia työkaluja. Tiedostoihin liittyvää:

    • Saat ruudulle tuotetun sanaston talteen näin: (ChatGPT: Copy Response, Gemini: Tallenna Driveen, Copilot: Vie kohteeseen > Word)
    • Voit kopioi sanaston chatbotista leikepöydälle, liittää tekstieditoriin ja tallentaa sieltä tiedostoksi.
    • SD:lle ja GD:lle kannattaa tehdä oma tallennuspaikka, jonne ne kaikki tallentaa
    • SD ja GD kannattaa nimetä niin, että ne yhdistää ilman, että tiedostoa täytyy avata. Esim. ”energetic-sd.docx” ja ”energetic-gd.docx” näkyvät kansion tiedostolistassa peräkkäin.
    • Sanastoa luodessa kannattaa avata chatbotissa uusi keskustelu. Tällöin sen mahdolliset (todennäköiset) virheilmoitukset löytää heti säikeen alkupäästä. Näin se ei myöskään pääse takertumaan johonkin, mitä säikeessä aiemmin on keskusteltu.

    Kerron juttusarjan seuraavassa, eli kuudennessa osassa, miten voi varmistaa, että sanastoon voi myös luottaa. Kehitin tätä varten erillisen GDV-työkalun (Glossary Document Verifier) ja ensi kerralla kerron, mitä se tekee ja miten sitä käytetään.

  • Sanaston synty (Osa 4)

    Sanaston synty (Osa 4)

    Tämä luku kertoo sanastogeneraattorin rakentamisen vaiheista, ongelmista ja ratkaisuista. Siitä, miten hanke muuttui oppimateriaalin tuottamisesta ohjelmoinniksi luonnollisella kielellä. Tämä on suunnattu erityisesti tekoälyn aktiivisille käyttäjille. Kielenopettajaa saattaa kiinnostaa lopun liitteenä oleva sanojen luokitus, mutta kielenopiskelijan kannattaa ihan oikeasti jättää tämä luku väliin.

    Versiohistoriaa

    Spesifikaatio kasvoi aluksi nopeasti, mutta myöhemmin sitä myös yksinkertaistaa. Tarkoituksena oli erottaa toisistaan dokumentointiin, tiedostonhallintaan ja varsinaiseen sanaston muodostamiseen liittyvät tehtävät. Uusimmissa versioissa painopiste siirtyi pedagogisiin ja kielellisiin ratkaisuihin. Seuraava taulukko antaa yleiskuvan versiokehityksestä:

    VersioPääosioita / alakohtiaTärkeimmät muutoksetToimivuus
    0.11 / 6Sanastoentryn rakenne, kolmen merkitystason selitys, selitettävä sana perusmuodossatesti
    0.24 / 15ulkoasun muotoiluja, lyric form ja taivutuksettesti
    0.34 / 18Tuotti kokonaisen sanaston. Dokumentin muoto ja rakenne vakiintuvat, mallina painetut sanakirjat.toimiva ja hidas
    0.57 / 30Mukaan How to Use, tulostus docx-tiedostoon, tiedoston nimeäminen ja metadata.epävakaa
    0.68 / 34Generation Assurance Rules lisätään. Pitkien ajojen ja keskeytysten hallinta.epävakaa
    0.79 / 38Ihmisohjeet poistuvat. Sisältösäännöt tarkentuvat, mutta Assurance säilyy.epävakaa
    0.89 / 39Lyric Glossary Spec nimettiin uudelleen Glossary Generation Speciksi, sillä ei ole käytännön syytä rajoittaa käyttöä pelkkiin laululyriikoihin.vakaa ja hidas
    0.815 / 39Säännöt ryhmitellään (Formatting, Content, Heading, Metadata…). Dokumenttirakenne selkeytyy.vakaa ja hidas
    0.8213 / 32Suuri pelkistys. Completeness Check, automaattinen regenerointi ja AI-keskeinen prosessi.vakaa ja hidas
    0.8314 / 34Output Header, Final Section ja Excluded-lista. Konjugaatiosääntö tarkentuu.vakaa ja hidas
    0.8414 / 34Semanttiset kerrokset ja prosessi hioutuvat, rakenne vakiintuu.vakaa ja hidas
    0.8514 / 35Romanisointi ja kielikohtaiset säännöt tarkentuvat.vakaa ja hidas
    0.8614 / 36Lyric Form muuttuu ehdolliseksi. Romanisointi (macronit) vakiintuu.vakaa ja hidas
    0.8715 / 38Quality Principle, GD-ajattelu, Ignore Metadata ja tuotannon tilastointi.vakaa
    0.9014 / 31Content Word Glossary. Partikkelit ja funktiosanat poistuvat, fraasit erotellaan.vakaa
    0.9115 / 33Word Boundary Rule.vakaa
    0.9215 / 35Sanaluokittelua tarkennetaan (mm. laskusanat, prefiksit, suffiksit).vakaa
    0.9315 / 38Merkityskerrokset nimetään (literal / abstract / poetic), Lyric Form uudistuu.vakaa
    0.9415 / 38Lyric Form yksinkertaistuu nykyiseen muotoon, glossary-entryjen puhtaus varmistetaan.vakaa ja nopea
    0.9517 / 50Luovuttiin vaatimasta ylitarkkoja sana- ja alaluokkia, Otettiin käyttöön pehmeäreunainen neljän ish-korin malli.vakaa ja nopea
    0.9617 / 50Lisättiin sanaston ylätunnistetiedotvakaa ja nopea
    0.9717 / 50Development Releasevakaa ja nopea

    Hankkeessa oli myös kriisivaihe, kun sanastojen luominen muuttui epävakaaksi. Jouduin umpikujaan, sillä en halunnut menettää tehtyä työtä ja uskoin tekoälyn ehdotuksiin  lisäsääntöjen hyödystä. Laitoin hankkeen tauolle maaliskuussa, enkä tiennyt miten jatkaa.

    Loppukevään työruuhkan vuoksi pääsin palaamaan hankkeeseen vasta kesällä. Puolen vuoden hanke oli siis tauolla lähes neljä kuukautta. Tauon aikana aloin ymmärtää, että tekoälyyn täytyy alkaa suhtautua aiempaa kriittisemmin. 

    Kehittäminen muutti tasapainoiluksi ominaisuuksien lisäämisen ja yksinkertaistamisen välillä. Osa säännöistä poistui kokonaan, osa yhdistettiin ja osa korvattiin myöhemmin tarkemmilla periaatteilla. Lopputuloksena syntyi yksinkertaisempi mutta samalla käsitteellisesti vahvempi spesifikaatio.

    Version 0.95 suuri alakohtien määrä (50 kpl) selittyy sillä, että määrityksessä piti luetella ne 17 mahdollista sana- ja alauokkaa, joita luokiteltiin lempeämmin neljään koriin. Esim. ”nounish” = substantiivit ja substantiivin tapaan käyttäytyvät.


    Ongelmia ja ratkaisuja

    Testattaessa havaittiin, että tekoäly on altis monenlaisille toimintahäiriöille.

    • Tekoäly tuottaa pienen näytteen ja kysyy, halutaanko käsitellä koko aineisto. Vaikka siihen vastaa myöntävästi, tekoäly jää jumiin.
    • Tekoäly tuottaa muutaman GE:n ja ilmoittaa, että tehtävä on suoritettu. Sillä ei näytä olevan aavistustakaan, että tehtävä jäi kesken.
    • Tekoäly alkaa keskeyttää generoimista varmistaakseen käyttäjältä, kummalla tavalla toimitaan. Tämä häiriö on helppo jäljittää monitulkintaisiin sääntöihin

    Tekoäly voi epäonnistua tehtävän suorittamisessa:

    • jos tekoälylle annettava lähdeteksti sisältää jotain yllättävää, mitä ei ole otettu huomioon.
    • jos tehtävään kuuluu tekoälyn mielestä liikaa aikaa
    • jos sääntöjä on liikaa, ne ovat monimutkaisia tai ovat ehdottomia
    • jos tekoäly suorittaa yhtä aikaa erilaisia, monivaiheista ja raskasta tehtäviä
    • jos sanastosta on tulossa niin laaja, että se ylittäisi tekoälylle asetetun ruudulle tuotettavan vastauksen pituusrajan

    Yritettäessä ratkaista versio 0.5:n keskeytymisongelmia, kysyttiin siitä myös tekoälyltä. Tämä oli suuri virhe, sillä tekoäly on hyvä generoimaan uusia sääntöjä, mutta kovin huono arvioimaan, ovatko säännöt ja tehtävät sille liian monimutkaisia.

    Yksi kehittämistyön perusongelma on, että tekoäly ei anna selkeitä virheilmoituksia. Jos siltä kysyy, mikä meni pieleen, se alkaa generoida mahdollisia selityksiä. Vaikuttaa siltä, että se ei tiedä itsekään. Olen kohdannut tämän useasti.

    Fraasit ovat sanaston kannalta hankalia: Fraasin merkitys on erilainen kuin sen osien summa. Ongelma ratkaistiin ohittamalla fraasit sanastosta ja luomalla niiden kääntäminen erillisen työkalun tehtäväksi. Tästä tarkemmin seitsemännessä luvussa.

    On hyvä huomata, että speksin laatu ja generoinnin vakaus ovat eri asioita. Hyväkin määritys voi epäonnistua yksittäisessä ajossa. Ja toisin päin: heikkokin määritys saattaa toimia vakaasti.


    Parhaat opit

    Nyt kun jälkikäteen palauttaa mieleen GGS:n kehittämisestä saatuja kokemuksia, ymmärtää aiempaa paremmin tekoälyn tuotantokäytön rajoituksia ja ylipäänsä sitä, miten nykyiset keskustelubotit toimivat. Esimerkiksi sääntöjen kohdalla on löydettävä tarkka tasapaino:

    • Jos tärkeitä sääntöjä puuttuu, tekoäly joutuu päättelemään, mitä pitää tehdä. Paljon toistuvassa silmukassa tämä hidastaa tehtävän suoritusta ja kuluttaa turhaan laskentatehoa,
    • Jos säännöt ovat tulkinnanvaraisia, tekoäly saattaa tuottaa tuloksia, jotka eivät ole sisällöltään sitä tai siinä muodossa kuin käyttäjä ne olisi halunnut.
    • Jos sääntöjä on liikaa, tehtävän suoritus hidastuu ja saattaa jumiutua.
    • Jos säännöt ovat ehdottomia, normaalista poikkeava lähdeteksti keskeyttää tehtävän suorituksen

    Tekoäly ei kerro, milloin käytettävissä oleva kapasiteetti ylittyy. En välitä, onko häiriön syy token-budjetti vai hetkellinen käyttäjäkuorma, mutta yritys-ja-erehdys-periaatteella tapahtuvalta kehittämistyöltä puuttuu laskentapohja. Se on kuin lähtisi vielä huhtikuussa pilkille ja toivoisi, että jäät edelleen kantavat.

    Tärkein oppi: tekoälyä ei kannata yrittää laittaa tekemään kaikkea ihmisen puolesta. Parempi työnjako on kolmikohtainen:

    1. Tekoälylle annetaan yksi selkeä tehtävä, jossa se on hyvä: tuottaa sanaston sisältötekstit.
    2. Ihminen hoitaa tehtävät, jotka vaativat harkintaa. Sanaston viimeistely julkaisukuntoon. sisältötekstin siivoaminen, merkkien ja kappaleiden muotoileminen, linkin ja metadatan lisääminen, pdf-viennin tekeminen ja tiedoston nimeäminen
    3. Päätehtävästä irrotettiin osatehtäviä, joita tekoäly suorittaa vain pyydettäessä. Tällaisia ovat sanaston tarkastaminen ja fraasien kääntäminen.

    Juttusarjan seuraavan, eli viidennen osan aiheita ovat sanaston generoiminen käytännössä, muokkaaminen dokumenttitiedostoksi ja sanastojen tiedonhallinta.

  • Sanaston synty (Osa 3)

    Sanaston synty (Osa 3)

    Sanastoihin liittyvä hanke ei olisi mitään ilman omaa sanastoa. Tässä on otettu käyttöön koodikieli, joka koostuu englanninkielisistä lyhenteistä. Ne eivät ole minkään olemassa olevan standardin mukaisia, vaan luovat tälle kohdealueelle omaa kieltä (Domain-Specific Language). Näiden lyhenteiden tehtävät ovat:

    • nimetä tekoälylle annettavat määritykset
    • nimetä tekstisisällöt eri käsittelyvaiheet
    • toimia tekstisisältöjen tunnisteina tiedostonimestä
    • viitataan asioihin tiiviisti ja nopeasti blogissa ja käyttöohjeissa

    SD (Source Document) tarkoittaa tiedostoksi tallennettua lähdetekstiä. Se liitetään kehotteeseen ja sanasto generoidaan siitä. Tekoäly ei siis etsi lähdetekstiä verkosta, vaan se pitää sille antaa. Tiedonhallinnan kannalta lähdetekstiin on tärkeää lisätä metadataa lähdetekstistä.

    GGS (Glossary Generation Specification) on määritys, joka kertoo tekoälylle, miten sanasto generoidaan: mitä sanoja lähdetekstistä (SD) poimitaan, mitä selityksissä on ja missä muodossa ne esitetään. Määritys poistaa käyttäjältä sanaston luomiseen tarvittavan kehotteen laatimisen vaivan ja pienentää tarvittavan tekoälyosaamisen määrää. Määritys myös yhtenäistää sanastojen sisältöä, mikä on tärkeää, kun sanastoja kootaan suuremmaksi kokoelmaksi.

    GD (Glossary Document) on valmis sanasto, joka on tallennettu tiedostoksi. Sanat ovat lähdetekstin esiintymisjärjestyksessä helpottamaan lähdetekstin seuraamista ja opiskelua.

    GDV (Glossary Document Verifier) on valmiin sanaston laadunvarmistustyökalu. Se on tekoälylle annettava määritys, jolla tarkistetaan sanaston termien ja selitysten oikeellisuus. GDV suunniteltiin aluksi opettajille, mutta on hyödyllinen työkalu kaikille sanastoja tekeville.

    GVR (Glossary Verification Report) on GDV:n tuottama raportti, josta näkee luotettavien, tarkistettavien ja väärien sanastoentryjen määrät, listaa tarkistettavat sanat ja selitykset ja ehdottaa niihin korjauksia.

    VGD (Verified Glossary Document) on valmis sanasto, joka on tarkastettu GDV:llä, muotoiltu tekstieditorilla ja tallennettu tiedostoksi.

    PET (Phrase Extraction Tool) on työkalu, joka tutkii SD:n ja etsii sieltä fraasit, kääntää ne 1. kirjaimellisen ja 2. kulttuurisen ja sosiaalisen merkityksen. PET tuottaa fraasilistan selityksin varustettuna.

    PGD (Phrase Glossary Document) on PET työkalun tuotos, joka on tallennettu tiedostoksi. Se sisältää useammasta merkistä muodostuvan kokonaisuudet, joiden merkitykset eroavat niiden kirjaimellisista merkityksistä.

    GCC (Glossary Collection Compiler) on tekoälylle annettava määritys, jolla erillisistä sanastoista (GD) kootaan laajempi kokonaisuus. Esimerkiksi kokonaisen albumin laulunsanat niin, että koostesanastossa on kukin sana vain yhteen kertaan ja aakkostettuna.

    GCD (Glossary Collection Document) tarkoittaa erillisistä sanastoista koostettua sanastoa, missä sanat ovat sanakirjamaisesti aakkosjärjestyksessä. Jos yksittäiset sanastot (VGD) tehdään musiikkikappaleista, sanastokokoelma voisi olla kokonaisen albumin kappaleiden sanastojen yhdistelmä.

    GDC (Glossary Document Collection) on sanastojen kokoelma, eli joukko erillisiä sanastotiedostoja. Termi ei ota kantaa siihen, onko niiden oikeellisuus varmistettu tai missä ne sijaitsevat.

    GDA (Glossary Document Archive) on yleistermi, joka viittaa sanastotiedostojen tallennuspaikkaan. Se voi olla yksittäinen tietokone, oppilaitoksen palvelin, verkkoasema tai siirrettävä tallennusväline. Ehkä jopa mappi, missä sanastot ovat paperitulosteina. Termi on käytössä siksi, että sillä voidaan tarkoittaa mitä tahansa tallennuspaikkaa niitä tarkemmin nimeämättä. Jokaisella sanastojen käyttäjällä ja esimerkiksi koululla voi olla oma niille varattu tallennuspaikka.

    GGM (Glossary Generation Manual) on ihmiskäyttäjälle tarkoitettu dokumentti, joka neuvoo, miten sanastoja generoidaan, mitä ongelmia on havaittu, miten niitä voi välttää, miten sanaston ulkoasu on hyvä muotoilla, miten sanastotiedosto tehdään ja miten sen laatu varmistetaan. Lisäksi siinä kerrotaan lyhyesti GGS:n muokkaamisesta.


    Juttusarjan seuraava, eli neljäs osa kertoo sanastogeneraattorin kehitysvaiheista, niissä kohdattuja ongelmista. ja niiden ratkaisuyrityksistä.

  • Sanaston synty (Osa 2)

    Sanaston synty (Osa 2)

    Tämä juttusarjan toinen osa on kirjoitettu oppijan ja opettajan näkökulmista. Aluksi pohditaan, miten sanoja opitaan koulun ulkopuolella, miten sanastot tukevat oppimista ja millaisia sanastoja tässä on rakennettu.


    Miten sanoja opitaan

    Jos puhutaan muualla kuin koulussa tai kurssilla tapahtuvasta kielten opiskelusta, sanoja ei yleensä opita kerralla. Niitä ensin huomaa, sitten arvailee ja vähitellen ne alkavat tarttua ja avautua. Seuraavassa omia havaintojani täysin vieraan uuden kielen kohtaamisesta.

    • Kun kuulet sanan ensimmäistä kertaa, ymmärrät, ettet tiedä mitä se tarkoittaa. Et ole varma, miten se kirjoitetaan ja lisäät sanan mielesi selviteltävien tapausten listalle.
    • Vertaat uutta sanaa jo tuntemiisi, samalta kuulostaviin sanoihin myös muissa osaamissasi kielissä.
    • Joskus uusi sana alkaa häiritä niin paljon, että sen selitys täytyy katsoa netistä. Opit sen heti, epätietoisuus ei enää häiritse ja uteliaisuutesi tyydyttyi.
    • Kun kohtaat sanan fraasissa, voit ymmärtää sen käytännön merkityksen vaikket vielä yksittäisen sanan kirjaimellista merkitystä. Muistat vain, että ”tuo sana oli siinä fraasissa”.
    • Alat arvailla ja päätellä monenlaisia asioita puhujan ympäriltä: Kuka puhuja on? Millaisista asioista tuossa asemassa / roolissa yleensä puhutaan?
    • Jos ymmärrät kielen sanoja ja rakenteita, voit alkaa haarukoida uuden sanan merkitystä ”verbi, jota voi käyttää meri-sanan kanssa
    • Kun et vielä osaa uutta sanaa, olet virittynyt erottamaan sen puhevirrasta ja huomaamaan sen esim. tv-ohjelmien tekstityksissä.
    • Olet oppinut sanan, kun tunnistat sen kuultuna ja kirjoitettuna, osaat sanoa ja kirjoittaa sen, tiedät sen merkityksen ja missä yhteydessä sitä voi käyttää.
    • Kun alat käyttää oppimaasi sanaa, olet saanut sen aktiiviseen sanavarastoosi.
    • Huomaat, että sanaa käytetään muissakin merkityksissä. Alat oppia erilaisia merkityksiä. Kun osaat tulkita sanan merkityksen sen käyttöyhteyden mukaan, olet lopulta ymmärtänyt sanan.

    Edellinen oli lineaarisesti eteneväksi siistitty lista. Oikeasti sanoja kuitenkin unohtaa, kuulee, ymmärtää, sanoo ja kirjoittaa väärin. Usein sanan merkityksen sekoittaa samalta kuulostavaan sanaan. Joskus näitä virheitä korjataan pitkänkin ajan päästä.


    Itsetehty sanasto

    Itse tuotettuja sanastoja voi hyödyntää monessa eri oppimiseen liittyvässä vaiheessa ja tehtävässä.

    • Jos sinulla on lähdeteksti ja sen rinnalla siitä generoitu sanasto, voit opetella kääntämään ja tulkitsemaan tekstiä ilman muuta oppimateriaalia.
    • Jos sanasto on luotu lähdeaineistosta, jonka olet kuullut, mutta et nähnyt, löydät sanastosta sanoille oikeat kirjoitusasut.
    • Tekstin kääntäminen on helpompaa, kun sanasto on järjestetty siten, että sanat esitetään siinä järjestyksessä, kun ne lähdetekstissä on esitetty.
    • Elävässä puhekielessä sanat sulautuvat paljon toisiinsa. Sanasto auttaa näkemään, missä yksi sana loppuu ja toinen alkaa. Kuvittele vaikka olevasi ulkomaalainen, joka yrittää ilman sanastoa tulkita suomen kielen repliikkiä ”emmäänyoikeintostatiiä”.
    • Se, että sanastoon on merkitty myös sanaluokat, helpottaa kielen rakenteiden hahmottamista. Esimerkki omasta äidinkielestä poikkeava sanajärjestys alkaa hahmottua, kun ymmärtää, esimerkiksi että ”tämä on substantiivi ja tuo on adverbi”.
    • Sanan eri merkitysten tarjoaminen syventää sen ymmärtämistä. Se mys totuttaa ajatukseen, että lukeminen on samalla tulkintaa, asiayhteyteen sopivan merkityksen valitsemista.

    Sanaston opettamisesta

    Tämän hankkeen perusidea on tehdä työkalu, joka tuottaa sanaston vapaasti valittavasta lähdetekstistä. Se sopii yhtä hyvin itseopiskelijan kuin opettajankin käyttöön. Opettajat selittävät sanoja ja kokoavat sanastoja jatkuvasti. Tähän työhön valjastetaan nyt tekoäly avuksi.

    Itse valitusta lähdetekstistä luotu sanasto tukee tosielämässä käytettävän, ajankohtaisen ja oppijalle merkityksellisen kielen oppimista. Oppijan motivaatio on korkeampi, kun sisältö on oikeasti oppijaa kiinnostavaa ja merkityksellistä. Fani haluaa oppia suosikkiartistinsa laulunsanoja, Japaninmatkaa suunnittelevan on tärkeä osata lentokentän ja metron kylttejä ja aasialaiseen keittiöön hurahtaneen on hyvä osata lukea pakkausmerkintöjä, esim. soijakastiketyypit pullon kyljestä.

    Normaalisti sanakirjoissa ja sanastoissa selitettävä sana on perusmuodossa. Tekstissä sanat ovat joskus perusmuodossa, mutta useammin eivät. Suomen ja Japanin kielet ovat siinä mielessä samanlaisia, että sanan perusmuodosta otetaan loppuosa pois ja se korvataan taivutuspäätteillä. Ne ovat aloitteleville opiskelijoille vaikeita, koska:

    • taivutuspäätteitä on useita erilaisia
    • sanojen taivuttaminen ei ole täysin mekaanista (osa on epäsäännöllistä)
    • sanan juuren perään voi olla liimattu useitakin taivutuspäätteitä

    Tällainen räätälöity sanasto voitaisiin tuottaa myös niin, että selitettävä sana on lähdetekstissä esiintyvässä muodossa. Näin voitaisiin tuottaa tekstin nopeaa ymmärtämistä tukevia sanastoja generoimalla esimerkiksi suomenkielisestä uutissähkeestä ukrainankielinen sanasto. Tällöin sanan perusmuodon voisi esittää selitysosan lopussa tukemaan sanojen oppimista.

    Sanaston opiskelu on entistäkin vaikeampaa, jos vieraan kielen teksti on kirjoitettu merkistöllä, jota oppija ei vielä tunne. Japanin kielen alkeisoppikirjat on ulkomaalaisia varten yleensä kirjoitettu länsimaisin aakkosin (romaji). Samalla ne myös kertovat, miten sanat lausutaan. Suomalaisille tämä on valtava etu, sillä sekä suomea että japania lausutaan pääosin niin kuin kirjoitetaan. Eli: suomalainen voi lukea romajilla kirjoitettua japania aivan suoraan.

    Sanastoon on tuotu sanat myös perinteisillä kirjoitusmerkeillä (kanji, hiragana ja katakana), jotta sanasto auttaa oppimaan ja käyttämään myös perinteisiä japanilaisia merkistöjä.

    Opettajan näkökulmasta itse tehty sanasto avaa uudenlaisia mahdollisuuksia. Oppijalle voidaan luoda opiskelupaketti, jossa on 1. linkki oppijan lempibiisiin, 2. biisin sanasto ja 3. pieni tehtävänanto, esim.

    • Opettele sanasto romaji-aakkosilla
    • Harjoittele ääntämistä laulajan perässä
    • Käännä kaksi ensimmäistä säkeistöä suomeksi
    • Tutki, mitä taivutuspäätteitä laulunsanoissa esiintyy
    • kuuntele kappale seuraten sanastoa samalla paperilta
    • Piirrä paperille kappaleen kymmenen ensimmäistä kanji-merkkiä.

    Miltä sanasto näyttää

    Sanastojen rakenne suunniteltiin aloittelijan tasolla olevan japanin itseopiskelijan tarpeita varten. Yksittäinen sanastoentry näyttää tältä:

    ikiru 生きる (verb) 1. To live; to be alive 2. To continue existing despite difficulty 3. To live with purpose or existential awareness (lyric form: iki|ta – past; completed action, may imply memory or finality)

    • Selitettävä sana perusmuodossa länsimaisilla merkeillä (romaji)
    • Selitettävä sana perinteisillä japanilaisilla merkeillä (kanji ja hiragana) tekemään niitä tutuiksi alusta pitäen ja helpottamaan siirtymistä käyttämään niitä opiskelun edetessä
    • Sanojen luokittelu helpottaa lauseen jäsentämistä ja japanin sanajärjestyksen ymmärtämistä.
    • Merkitystasot ohjaavat tulkitsemaan sanojen merkityksiä opiskelun alusta pitäen. Tasoja on useita: kirjaimellinen, käytännöllinen, historiallinen, abstrakti, teoreettinen, poeettinen, vertauskuvallinen, filosofinen. Tähän sanastoon otettiin kolme (kirjaimellinen, abstrakti ja runollinen).
    • Lyric form: sana siinä muodossa, miten se tekstissä esiintyy ja sen käännös.

    Esimerkkejä valmiista sanastoista:

    • Eir Aoi: Ryūsei (流星) (pdf 4 s. CC BY 4.0, FI)
    • HACHI: Hoshi wo matsu (星を待つ) (pdf, 4 s. CC BY 4.0, EN)
    • Hakubi: Twilight (pdf, 3 s. CC BY 4.0, EN)

    Juttusarjan seuraavassa, eli kolmannessa osassa luodaan hankkeelle oma kieli. Oikeasti! Sen avulla voimme jatkossa viitata asioihin tiiviisti ja tehokkaasti.

  • Nopeat ohjeet hitaaseen ajatteluun

    Keskustelubotit ovat kehittyneet sille tasolle, että niiden kanssa voi jo käydä pitkiäkin keskusteluja. Toisin kuin meille on aiemmin opetettu, enää ei tarvitse viritellä täydellistä kehotetta, joka tuottaisi heti täydellisen vastauksen.

    Tämä mahdollistaa keskustelubottien käytön hakukoneita monipuolisemmin: se tukee enemmän prosessia kuin pelkkää lopputulosta. Tämä on ajatustyötä vuoropuheluna: Voit kehittää ideoita, selkeyttää epäselviä asioita ja kirjoittaa tekstiä yhdessä.

    Suurin riski tekoälyn käytöstä opiskelun tukena on tämä: jos pyydät tekoälyltä nopean vastauksen, saat jotain vakuuttavan näköistä, mutta ohitat samalla oman kognitiivisen prosessisi. Voit jopa kokea, ettei tätä tarvitse miettiä enempää. Opit yksittäisiä asioita, mutta jos ajatusrakenteesi eivät saa tilaisuutta muuttua, ajattelusi ei juuri kehity.

    Voit välttää riskin, kun et ulkoista ajattelua kokonaan, vaan mietit yhdessä tekoälyn kanssa. Sopivassa tahdissa ja sopivan kokoisina annoksina. Sen verran kuin kerralla jaksat. Palaat sitten jatkamaan samaa keskustelua vaikka heti huomenna.

    Jos tällainen työskentely kiinnostaa, tässä on helposti ahmaistava pikaohje. Eräänlainen anti-huoneentaulu. Syvä ironia tunnistettu: Näin pääset nopeasti ajattelemaan hitaammin.


    Ajattelua tekoälyn kanssa (pdf, 1 s. CC BY 4.0)

    Thinking with AI (pdf, 1 p. CC BY 4.0)


    Ohje on julkaistu 9.4.2026 EPALE-blogin bonusmateriaalina ja nyt avoimessa verkossa tällä julkaisualustalla.

  • Aineistot ja ajatukset jakoon

    Tämä on SASKYn ja Petäjä-opiston avoimien oppimateriaalien jakelualusta. Blogipohjainen ratkaisu on kevyt ja kätevä työkalu avoimeen, jatkuvaan ja epäsäännölliseen julkaisemiseen.

    Tulossa on sisältöjä monista eri aiheista. Niitä ovat ainakin kielet ja kirjoittaminen, digitaidot ja tekoäly, oppiminen ja tietoisuustaidot. Materiaalit ovat monenmuotoisia: harjoitusaineistoja, kuratoituja lähteitä ja käyttöohjeita. Joskus paikallaan on myös esseemäinen pohdinta ja tarinankerronta.

    Avoimuus on käytännössä sitä, että sisältöihin pääsee käsiksi ilman käyttäjätunnuksia ja kirjautumista. Materiaalit julkaistaan Creative Commons ‑lisenssillä aina kun mahdollista.