Přejít k obsahu


Building LVCSR system for transcription of spontaneously pronounced russian testimonies in the MALACH project: initial steps and first results

Citace: [] PSUTKA, J., ILJUCHIN, I., IRCING, P., PSUTKA, J., TREJBAL, V., BYRNE, W., HAJIČ, J., GUSTMAN, S. Building LVCSR system for transcription of spontaneously pronounced russian testimonies in the MALACH project: initial steps and first results. Lecture Notes in Artificial Intelligence, 2003, roč. 2807, č. 2807, s. 327-332. ISSN: 0302-9743
Druh: ČLÁNEK
Jazyk publikace: eng
Anglický název: Building LVCSR system for transcription of spontaneously pronounced russian testimonies in the MALACH project: initial steps and first results
Rok vydání: 2003
Místo konání: Berlin
Název zdroje: Springer
Autoři: Josef Psutka , Ilja Iljuchin , Pavel Ircing , Josef Psutka , Václav Trejbal , William Byrne , Jan Hajič , Samuel Gustman
Abstrakt CZ: Projekt MALACH využívá největší světový archiv videovýpovědí svědků holocaustu, které byly shromážděny v Shoah Visual History Foundation (VHF) a pokouší se přistoupit k tomuto archivu využitím nejnovějších poznatků z oblasti automatického rozpoznávání řeči a vyhledáváním informací. Článek diskutuje počáteční etapy a první výsledky řešení projektu při budouvání systému rozpoznávání souvislé spontánní řeči ruských svědků holocaustu.
Abstrakt EN: The MALACH project uses the world's largest digital archives of video oral histories collected by the Survivors of the Shoah Visual History Foundation (VHF) and attempts to access such archives by advancing the state-of-the-art in Automated Speech Recognition (ASR) and Information Retrieval (IR). This paper discusses the initial steps and the first results in building large vocabulary continuous speech recognition (LVCSR) system for transcription of Russian witnesses. Russian as the third language processed in the MALACH project (after English and Czech) brought new problems especially in the phonetic area. Although the most of the Russian testimonies were provided by native Russian survivors we have encountered many different accents in their speech caused by a territory where the survivors are living.
Klíčová slova

Zpět

Patička