Tut­ki­ja­toh­to­ri puhe- ja kie­li­tek­no­lo­gian alal­le

Aalto-yliopistoEspoojoblyfipaskelbta 2026-09-18
Privaloma:PythonAI

Aalto-yliopistossa tiede ja taide kohtaavat tekniikan ja talouden. Rakennamme kestävää tulevaisuutta saavuttamalla läpimurtoja avainalueillamme ja niiden yhtymäkohdissa. Samalla innostamme tulevaisuuden muutoksentekijöitä ja luomme ratkaisuja maailman suuriin haasteisiin. Yliopistoyhteisöömme kuuluu 16 000 opiskelijaa, 446 professoria ja yli 5000 työntekijää, jotka edustavat yhteensä yli 120 kansalaisuutta.  Kampuksemme sijaitsee Espoon Otaniemessä. Monimuotoisuus on osa meitä, ja teemme jatkuvaa työtä yhteisömme monimuotoisuuden ja syrjimättömyyden varmistamiseksi. Siksi kannustammekin päteviä hakijoita taustasta riippumatta liittymään yhteisöömme.

Tutkimus tehdään Aalto-yliopiston informaatio- ja tietoliikennetekniikan laitoksella, DICEssä. Projektiympäristö tarjoaa erinomaiset puitteet syväoppimisen, puheen ja audion tutkimukseen. Käytettävissä ovat muun muassa Aalto-yliopiston tieteellisen laskennan klusteri, CSC:n kansallinen laskentainfrastruktuuri mukaan lukien LUMI sekä Aallon Akustiikan Laboratorion kaiuttomat huoneet, kuunteluhuoneet ja audiomittauslaitteet. 

Haemme nyt tutkijatohtoria puhe- ja kieliteknologian alalle

Kiinnostaako sinua läpinäkyvyys, sisällön alkuperä ja jäljitettävyys tekoälyn tuottamassa puheessa, musiikissa ja audiossa? Haemme tutkijatohtoria mukaan COWAMA: Content-based watermarking for AI-generated audio -projektiin, jota johtaa apulaisprofessori Lauri Juvela.

Generatiivinen tekoäly pystyy nykyisin tuottamaan yhä realistisempaa puhetta ja musiikkia, mikä herättää tärkeitä kysymyksiä misinformaatiosta, tekijänoikeuksista, omistajuudesta, attribuutiosta ja vastuullisuudesta. EU:n tekoälysäädös edellyttää, että generatiiviset tekoälyjärjestelmät merkitsevät tuotetun sisällön, mutta ulkoinen metadata on helppo poistaa. Siksi tarvitaan myös teknisiä menetelmiä läpinäkyvyyden ja tunnistamisen tukemiseksi. Tässä projektissa kehitetään vesileimausmenetelmiä ja ohjelmistoja puheen ja audion generatiivisiin malleihin. Erityisenä painopisteinä ovat menetelmien robustius ja soveltuvuus avoimen lähdekoodin käyttöön.

Roolisi

Tutkijatohtorina otat päävastuun syvien sisältöpohjaisten vesileimojen kehittämisestä audiolle ja työskentelet yhdessä väitöskirjatutkijan kanssa robustiuden, arvioinnin ja yleistettävyyden parissa.

Tehtäviisi kuuluu:

Uusien sisältöpohjaisten vesileimausmenetelmien kehittäminen generoidulle puheelle, musiikille ja äänelle

Tunnistusmenetelmien ja laatumittojen suunnittelu tilanteisiin, joissa generoitu audio voi poiketa alkuperäisestä referenssisisällöstä

Menetelmien kehittäminen esimerkiksi audiosisällön tunnistuksessa, musiikki-informaation haussa, audiosormenjäljissä, itseohjattujen audiorepresentaatioiden piirrevastaavuuksissa ja referenssittömässä äänen laadun ennustamisessa

Vesileimauksen integroiminen syviin generatiivisiin audiopmalleihin, mukaan lukien kollaboratiivisen vesileimauksen käyttö diffuusiomalleissa ja neuraalisiin audiokoodekkeihin perustuviin audion kielimalleissa

Sen tutkiminen, voidaanko vesileimainformaatiota upottaa pitkäkestoiseen sisältöön, kuten puheen semantiikkaan, kestoon, prosodiaan tai painotuksiin, eikä ainoastaan paikallisiin signaalitason piirteisiin

Robustiuden arviointimenetelmien, differentioituvien augmentaatiotyökalujen ja realististen hyökkäysskenaarioiden kehittäminen audiovesileimoille

Tutkimuksen julkaiseminen johtavissa puheen, audion ja koneoppimisen julkaisuissa ja konferensseissa sekä osallistuminen ohjelmistojen, koulutettujen mallien ja toistettavien tutkimustuotosten avoimiin julkaisuihin.

Tutkimusmenetelmiin kuuluvat kokeiden suunnittelu, ohjelmistototeutus, syväoppimiskokeiden ajaminen suurteholaskentainfrastruktuurissa sekä arviointi objektiivisilla mittareilla ja subjektiivisilla kuuntelukokeilla.

Verkostosi ja tiimisi

Ohjaajanasi toimii apulaisprofessori Lauri Juvela, joka johtaa Aalto-yliopiston Speech Synthesis -tutkimusryhmää. Ryhmä työskentelee syvien generatiivisten puhe- ja audiomallien, puhesynteesin, differentioituvan signaalinkäsittelyn, deepfake-tunnistuksen ja vesileimauksen parissa.

Aallon puheryhmien ja projektin tutkijatohtorin lisäksi työskentelet kansainvälisessä yhteistyöverkostossa, johon kuuluvat muun muassa professori Junichi Yamagishi National Institute of Informatics -instituutista Japanista, professori Xavier Serra Universitat Pompeu Fabrasta Espanjasta ja professori Gustav Eje Henter KTH Royal Institute of Technologysta Ruotsista. Yhteistyöverkostolla on vahva tausta puheen ja audion synteesissä, syvissä generatiivisissa malleissa ja deepfake-tunnistuksessa, mikä tekee projektista hyvin asemoituneen vaikuttamaan tekoälyllä tuotetun audion vesileimaukseen ja lähteen jäljittämiseen.

Odotamme sinulta

Etsimme motivoitunutta tutkijaa, jolla on vahva kiinnostus generatiiviseen tekoälyyn, puheeseen, musiikkiin ja audioteknologioihin. Tehtävässä onnistuminen edellyttää:

Tohtorin tutkintoa tai pian valmistuvaa tohtorin tutkintoa puheen- tai audionkäsittelyn, koneoppimisen, signaalinkäsittelyn, tietojenkäsittelytieteen tai muun soveltuvan alan parissa

Vahvaa kokemusta syväoppimisesta ja generatiivisista malleista

Ohjelmointitaitoja, jotka soveltuvat nykyaikaiseen koneoppimistutkimukseen, mukaan lukien Python ja syväoppimisen työkalut

Kiinnostusta yhteen tai useampaan seuraavista alueista: puhesynteesi, musiikin generointi, neuraaliset audiokoodekit, diffuusiomallit, audio-kielimallit, vesileimaus, deepfake-tunnistus, audiolaadun arviointi tai audiorepresentaatioiden oppiminen

Kykyä tehdä itsenäistä tutkimusta ja julkaista korkeatasoisissa vertaisarvioiduissa julkaisufoorumeissa

Motivaatiota työskennellä avoimeen tieteeseen suuntautuneessa projektissa, jossa kehitetään avoimen lähdekoodin ohjelmistoja ja toistettavia tutkimustuotoksia

Hyviä yhteistyö- ja viestintätaitoja kansainvälisessä tutkimusympäristössä

Sujuvaa englannin kielen taitoa. Suomen kielen taitoa ei edellytetä.

Tohtori- ja maisteritason ohjauskokemus katsotaan eduksi.

Tarjoamme

Merkityksellisen ja ajankohtaisen tutkimusaiheen generatiivisen tekoälyn, audioteknologian, läpinäkyvyyden ja digitaalisen luottamuksen rajapinnassa. Projekti vastaa tarpeeseen kehittää parhaita käytäntöjä ja standardeja tekoälyllä tuotetun sisällön käsittelyyn avoimilla, läpinäkyvillä ja hajautetuilla akateemisilla ratkaisuilla.

Mahdollisuuden työskennellä menetelmien parissa, jotka parantavat tekoälyllä tuotetun puheen ja audion läpinäkyvyyttä ja turvallisuutta vesileimauksen, lähteen jäljittämisen ja deepfake-tunnistuksen avulla

Pääsyn erinomaiseen laskenta- ja tutkimusinfrastruktuuriin, mukaan lukien Aallon CPU/GPU-klusterit, CSC ja LUMI, FIN-CLARINin kieliresurssit sekä Aallon Akustiikan Laboratorio

Kansainvälisen yhteistyöverkoston johtavien puhesynteesin, musiikkiteknologian, deepfake-tunnistuksen ja audion generoinnin tutkijoiden ja organisaatioiden kanssa

Vahvan tuen avoimelle tieteelle, mukaan lukien avoin julkaiseminen sekä ohjelmistojen, mallien ja aineistojen avoin julkaisu

Mielekäs ja innostava ympäristö. Olemme ylpeitä tarkoituksestamme muokata kestävää tulevaisuutta. Uudistamme yhteiskuntaa tutkimukseen perustuvalla tiedolla, luovuudella ja yrittäjähenkisyydellä.

Kulttuuri, jossa kaikki ovat arvostettuja. Kaikkea työtämme ohjaavat yliopiston arvot: vastuullisuus, rohkeus ja yhteistyö. Olemme avoin yhteisö, jossa tasa-arvo ja inklusiivisuus mahdollistavat uteliaisuuden, innovatiivisuuden, yhteistyön ja hyvinvoinnin.

Tukea, ohjausta ja sparrausta tarvittaessa.

Suuret mahdollisuudet osaamisen kehittämiseen ja oppimiseen. Pyrimme hyödyntämään jokaisen aaltolaisen vahvuuksia ja intohimoja parhaalla mahdollisella tavalla. Autamme toisiamme menestymään, keskittyen yhteisöön ja ihmisiin uutta oppien.

Pyrimme yhdistämään etä- ja lähityöskentelyn parhaat puolet. Lähityöpisteesi sijaitsee uudistuneella ja elävällä Otaniemen kampusalueella, jossa on monipuoliset palvelut ja hyvät kulkuyhteydet.

Tehtävän palkkaus määräytyy Aalto-yliopistossa käytössä olevan yliopistojen palkkausjärjestelmän mukaisesti. Tutkijatohtorin tehtävän aloituspalkka on 4220 €/kk, ja palkka nousee suoriutumisen perusteella. Tehtävä on määräaikainen ja kestää kaksi vuotta. Projektin rahoitus on myönnetty neljäksi vuodeksi ja työsopimusta on mahdollista jatkaa toiset kaksi vuotta. Tehtävä alkaa tammikuussa 2027 tai sopimuksen mukaan.

Työtehtävät on suoritettava Suomessa.

Kiinnostuitko?

Jos innostuit tehtävästä ja haluat liittyä joukkoomme, lähetä CV, motivaatiokirje sekä kopiot tutkintotodistuksista ja opintosuoritusotteista rekrytointijärjestelmämme (”Apply now!” sivun alaosassa) kautta viimeistään  31.10.2026 klo 23.59 (EET) .

Aalto-yliopiston nykyisten työntekijöiden tulee hakea tehtävään omalla työntekijäprofiilillaan Workday-järjestelmän kautta (internal jobs/sisäiset työpaikat). Aallon opiskelijat tai vierailijat hakevat henkilökohtaisella sähköpostiosoitteella (ei aalto.fi) ulkoisen Avoimet työpaikat -sivun kautta.

Lisätietoja tehtävästä antaa Lauri Juvela,  lauri.juvela@aalto.fi , +358 50 464 6653. Hakemiseen liittyvissä kysymyksissä auttaa HR Advisor Johanna Haapalainen,  hr-elec@aalto.fi .

Käymme hakemuksia läpi ja voimme kutsua sopivia hakijoita haastatteluun jo hakuaikana. Kuulet meistä viimeistään 15.11.2026. Pyrimme läpinäkyvään ja yhdenvertaiseen rekrytointiprosessiin, joten voit pyytää meiltä palautetta.

Haluatko tietää lisää meistä ja tulevista kollegoistasi? Voit katsoa nämä videot: 

This is Aalto University!   Aalto University – Towards a better world   ja Shaping a Sustainable Future . 

Lue lisää työskentelystä Aallossa: https://www.aalto.fi/fi/toihin-aaltoon ja käy tutustumassa uuteen virtuaalikampus-kokemukseen: https://virtualtour.aalto.fi .

Kontaktinis asmuo

Nurodyta darbdavio skelbime — klausimams ir tavo kandidatavimui.

  • Lauri Juvelaapulaisprofessori