Studiolaatuinen mikrofoni. Takana ikkuna, jossa kesäiset maisemat. Pöydällä vaaleanpunainen kesäkukka.

Alkuvuoden koneääni-uutiset maailmalta

Vuosi ei ole vielä pitkällä, mutta koneäänistä on kuulunut jo nyt muutamakin mielenkiintoinen uutinen. Tässä lisää niistä:

VALL-E, koneääni kolmen sekunnin ääninäytteestä

Sisällön luominen tekoälyä käyttäen tuli viime vuonna ihmisille tutuksi. Vuoden 2022 puolivälissä kokeiltiin DALL-E:tä ja vuoden lopussa puhututti ChatGPT. DALL-E on tekoälypohjainen ohjelma, joka luo kuvia sille syötetyn tekstin perusteella. ChatGPT taas on ihmiskeskustelijaa jäljittelevä chatbot. Sille syötettyjen avainsanojen tai aiheiden perusteella se voi luoda pyynnöstä niin laulun sanat, tiivistelmän, esseen kuin runonkin. Sisällöntuotannossa ChatGPT toimii esimerkiksi hyvänä inspiraation lähteenä. DALL-E ja ChatGPT ovat molemmat OpenAI:n kehittämiä.

Microsoft esitteli edellä mainittujen kanssa samantyyppisen VALL-E -tekoälymallin heti vuoden 2023 alkuun. VALL-E on tekstistä puheeksi -työkalu, joka pystyy jäljittelemään kenen tahansa puheääntä pelkästään kolmen sekunnin ääninäytteen perusteella. Pystyt siis luomaan esimerkiksi omasta äänestäsi koneäänen ja tämän jälkeen muuttaa tekstisisältöjä puheeksi sinulta kuulostavan äänen lukemina, vain kolmen sekunnin ääninäytteellä. Yleensä koneäänet luodaan useamman kymmenen tunnin ääninäytteen pohjalta.

VALL-E pystyy myös säilyttämään puhujan tunnetilan ja akustiikkaympäristön, jotka osaltaan lisäävät tuotetun koneäänen realistisuutta. Sen kouluttamiseen on käytetty yhteensä 60 000 tuntia englanninkielistä puhetta yli 7000 puhujalta. Aikaisemmissa järjestelmissä puhetta on käytetty noin 600 tuntia.

VALL-E ei ole ainakaan toistaiseksi saatavissa julkiseen käyttöön. Microsoftin antaman eettisen lausunnon mukaan puhujan identiteetin säilyttävään syntetisoituun puheeseen liittyy mahdollisia riskejä mallin väärinkäytöstä. Näitä ovat esimerkiksi äänentunnistuksen huijaaminen ja toisena henkilönä esiintyminen. Jos mallia käytetään, puhujan täytyykin vahvistaa hyväksyvänsä äänensä käytön koneääneksi. Yllä mainittuja riskejä minimoimaan voidaan Microsoftin mukaan kehittää esimerkiksi tunnistusmalli, joka pystyy erottamaan äänen VALL-E:n syntetisoimaksi. VALL-E on erittäin mielenkiintoinen työkalu, ja tuo hienoja mahdollisuuksia esimerkiksi heille, jotka ovat menettäneet äänensä vaikkapa onnettomuuden seurauksena.

Apple julkaisee koneäänen lukemia äänikirjoja

Apple Books kirjapalvelu on tuonut markkinoille uuden mahdollisuuden julkaista kirjoja koneäänen lukemana. Apple kertoo täten tekevänsä äänikirjojen luomisesta helppoa myös yksittäisille kirjailijoille ja pienille kustantamoille. Palvelun kautta pienet toimijat voivat näin tavoittaa lisää yleisöä äänikirjakuuntelijoista. Sloganina onkin: Jokainen kirja ansaitsee tulla kuulluksi.

Ihmislukijoita ei koneäänellä olla korvaamassa ja Apple vakuuttaa jatkavansa edelleen ääninäyttelijöiden lukeman äänikirjavalikoiman kasvattamista. Koneäänellä luetut äänikirjat ovat kuitenkin pienemmille toimijoille tilaisuus päästä äänikirjamarkkinoille, sillä ne tulevat edullisemmaksi kuin studion ja ääninäyttelijän käyttäminen. Koneäänien käyttö nähdään siis mahdollisuutena kasvattaa äänikirjamarkkinoita entisestään.

Äänikirjan lukijaksi voi valita sopivan koneäänen muutamasta vaihtoehdosta. Valittavissa olevat koneäänet ovat hyvin luonnollisen kuuloisia ja niiden kehityksessä on ollut myös yhteistyötä kustantamoiden, kirjailijoiden ja ääninäyttelijöiden kanssa. Toistaiseksi on mahdollista julkaista vain englanninkielisiä äänikirjoja. Luultavasti palvelu kuitenkin laajenee ajan myötä ja uusia vaihtoehtoja tulee käytettäville. Mielenkiintoista nähdä vaikuttaako Applen uusi käytäntö myös muihin äänikirjapalveluihin; esimerkiksi Amazon on kirjannut ohjeisiinsa, että se hyväksyy Audible-palveluunsa vain ihmisen lukemat äänikirjat.

Vielä toistaiseksi koneäänet sopivat parhaiten faktapohjaisten äänikirjojen lukemiseen. Kehitys kuitenkin kehittyy ja koneääniin tullaan saamaan vielä paremmin tunnetiloja mukaan. Kun VALL-E:n kaltaiset mallit edistyvät, tulevaisuudessa esimerkiksi ääninäyttelijät saattavat tuottaa äänistään luonnollisen kuuloisia koneääniä ja saada sivutuloja äänensä monipuolisemmasta hyödyntämisestä.

Kiinnostuitko? Ota Yhteyttä!

Jaa artikkeli

LinkedIn
Twitter
Facebook
Tekstinlouhinta on tekoälypohjainen menetelmä, jolla tekstimassoista löydetään niihin piiloutuvaa tietoa. Kuvassa mies istuu Excelin edessä ja takana vaaleat ruudukkoikkunat kesämaisemalla.
Tekoälypohjaisilla tekstinlouhinnan työkaluilla laajoista tekstimassoista löydetään tekstisisältöön piiloutuvia tärkeitä havaintoja. Parhaimmillaan nämä oivallukset voivat jopa lisätä niitä käyttävien yritysten kilpailuetua.
Taustalla punahiuksinen nainen, jolla kuulokkeet päässä. Kuvan päällä sumennettu suorakulmio, jossa lukee: Helmikuun ääniuutiset. Tekstin alla on piirretty valkoinen ääniaalto alleviivaamaan tekstiä.
Kokosimme koko helmikuun ajalta yhteen artikkeliin mielenkiintoisimmat koneääni- ja puheentunnistusuutiset maailmalta. Voit myös kuunnella artikkelin Ilonan lukemana.
Mies istuu tietokoneen edessä kuulokkeet päässä. Hän nauhoittaa studiomikkiin puhettaan. Takana on ristikkoikkunat, joista näkyy vihreää luontoa.
Äänen kloonauksella tavoitellaan synteettistä ääntä, joka muistuttaa mahdollisimman paljon alkuperäistä puhujaa. Artikkelissa menetelmän hyödyistä ja syväväärennösten riskeistä.
Mies istuu korituolissa laiturin nokassa ja katsoo merelle. Vieressä on kirjapino, jonka päällä älypuhelin. Miehellä on t-paita päällä ja kuulokkeet päässä.
Aikakausmediat näkevät tärkeimpinä syinä äänisisältöjen tekemiselle nuoren ja uuden yleisön tavoittamisen. Suosituin äänisisällön muoto on podcastit.
Nainen makaa selällään silmät kiinni ja kuulokkeet korvilla, vierellä on lautasellinen pilkottuja hedelmiä.
Koneäänet antavat kuluttajalle mahdollisuuden päättää, missä muodossa haluaa sisältönsä kuluttaa. Samalla lisätään sisällön saavutettavuutta.
Luokkakuvassa kaikki a.i.materin seitsemän työntekijää. Sohvalla istuvat Niko, Antti, Aleksi ja Eve. Takana seisovat Aki, Lauri ja Kai.
Katsaus a.i.materin vuoteen 2022: mitä kaikkea pääsimme tekemään ja miten meillä sujui.