login

Automatic punctuation annotation in czech broadcast news speech

Digital Library (University of West Bohemia)Published 20 September 2004Open access
Jáchym Kolář, Ján Švec, Josef Psutka
Citations32
View PDF

TL;DR

This paper reports the initial experiments with automatic punctuation annotation from speech on Czech broadcast news speech using prosodic model and language model, and the model combining language model with the decision tree yielded superior results.

Abstract

Tento článek se zabývá našimi počátečními experimenty s automatickou anotací interpunkce v mluvené češtině. Použili jsme 2 statistické modely - prozodický a jazykový. Byly otestovány 2 implementace prozodického modelu - CART a MLP. Pro jazykové modelováni byl použit N-gramový model se skrytými událostmi. Kombinovaný model dosáhl na referenčních přepisech přesnosti 95.2% a F-measure 78.2%.

Keywords

Computer Science