A decoder for large-vocabulary continuous speech recognition
dc.contributor | Aalto-yliopisto | fi |
dc.contributor | Aalto University | en |
dc.contributor.author | Hirsimäki, Teemu | |
dc.contributor.department | Tietotekniikan osasto | fi |
dc.contributor.school | Teknillinen korkeakoulu | fi |
dc.contributor.school | Helsinki University of Technology | en |
dc.contributor.supervisor | Kurimo, Mikko | |
dc.date.accessioned | 2020-12-04T15:17:26Z | |
dc.date.available | 2020-12-04T15:17:26Z | |
dc.date.issued | 2002 | |
dc.description.abstract | Yksi automaattisten puheentunnistusjärjestelmien keskeisistä osista on dekooderi, jonka tehtävänä on etsiä akustisten mallien ja kielimallien perusteella parhaiten puheeseen sopiva sanajono. Tässä diplomityössä on toteutettu dekooderi C++-kielellä tutkimuskäyttöön. Erityisesti huomiota on kiinnitetty siihen, että dekooderin kanssa voidaan käyttää suuria sanastoja ja laajan kontekstin kielimalleja. Järjestelmän perustana on niin kutsuttu pinomenetelmä, jossa tunnistushypoteeseja pidetään ajan mukaan järjestetyissä pinoissa. Lisäksi akustinen mallinnus on erotettu kielimallinnuksesta, minkä vuoksi laajojenkin kielimallien liittäminen järjestelmään on mahdollista. Dekooderin toteutuksen lisäksi tässä työssä kuvataan myös puheentunnistusjärjestelmän muiden tärkeimpien osien toimintaa sekä oleellisimpia ongelmia, joita täytyy ratkaista, kun foneemipohjaisen tunnistuksen sijaan tehdäänkin sanastoihin ja kielimalleihin perustuvaa tunnistusta. Järjestelmän toimivuutta on testattu suomenkielisellä puheaineistolla, ja testeissä on tutkittu sanaston koon ja dekooderin parametrien vaikutusta tunnistustuloksiin. | fi |
dc.format.extent | 46 | |
dc.identifier.uri | https://aaltodoc.aalto.fi/handle/123456789/90171 | |
dc.identifier.urn | URN:NBN:fi:aalto-2020120449006 | |
dc.language.iso | en | en |
dc.programme.major | Informaatiotekniikka | fi |
dc.programme.mcode | T-61 | fi |
dc.rights.accesslevel | closedAccess | |
dc.subject.keyword | decoder | en |
dc.subject.keyword | dekooderi | fi |
dc.subject.keyword | speech recognition | en |
dc.subject.keyword | puheentunnistus | fi |
dc.subject.keyword | continuous speech | en |
dc.subject.keyword | jatkuva puhe | fi |
dc.subject.keyword | large vocabulary | en |
dc.subject.keyword | suuri sanasto | fi |
dc.subject.keyword | language models | en |
dc.subject.keyword | kielimallit | fi |
dc.subject.keyword | hidden Markov models | en |
dc.subject.keyword | kätketyt Markov-mallit | fi |
dc.title | A decoder for large-vocabulary continuous speech recognition | en |
dc.title | Suurten sanastojen dekooderi jatkuvan puheen tunnistukseen | fi |
dc.type.okm | G2 Pro gradu, diplomityö | |
dc.type.ontasot | Master's thesis | en |
dc.type.ontasot | Pro gradu -tutkielma | fi |
dc.type.publication | masterThesis | |
local.aalto.digiauth | ask | |
local.aalto.digifolder | Aalto_03351 | |
local.aalto.idinssi | 19051 | |
local.aalto.openaccess | no |