Detail předmětu

Zpracování řečových signálů

FIT-ZREAk. rok: 2010/2011

Jazyk výuky

čeština

Počet kreditů

5

Základní literatura

Psutka, J.: Komunikace s počítačem mluvenou řečí. Academia, Praha, 1995, ISBN  80-200-0203-0 

Doporučená literatura

  • Psutka, J.: Komunikace s počítačem mluvenou řečí. Academia, Praha, 1995, ISBN  80-200-0203-0
  • Gold, B., Morgan, N.: Speech and Audio Signal Processing, John Wiley & Sons, 2000, ISBN 0-471-35154-7

Zařazení předmětu ve studijních plánech

  • Program IT-MGR-2 magisterský navazující

    obor MBS , libovolný ročník, letní semestr, volitelný
    obor MIS , libovolný ročník, letní semestr, volitelný
    obor MIN , libovolný ročník, letní semestr, povinně volitelný
    obor MMM , libovolný ročník, letní semestr, volitelný
    obor MBI , 1. ročník, letní semestr, povinně volitelný
    obor MMI , 1. ročník, letní semestr, povinně volitelný
    obor MGM , 1. ročník, letní semestr, povinný
    obor MPS , 1. ročník, letní semestr, volitelný
    obor MPV , 2. ročník, letní semestr, povinně volitelný
    obor MSK , 2. ročník, letní semestr, povinně volitelný

Typ (způsob) výuky

 

Přednáška

26 hod., nepovinná

Vyučující / Lektor

Osnova

  • Úvod, aplikace zpracování řeči, relevatní vědní obory,  informační obsah.
  • Číslicové zpracování řečových signálů
  • Tvorba a slyšení řeči, základní pojmy z psychoakustiky, aplikace ve zpracování řeči.
  • Úvod do fonetiky, mezinárodní normy pro označování fonémů.
  • Předzpracování a základní parametry. 
  • Lineárně-prediktivní model, spektrum pomocí lineární predikce. Aplikace LP. 
  • Cepstrální analýza, Mel-frekvenční cepstrum
  • Určování základního tónu hlasu
  • Kódování řeči.
  • Rozpoznávání řeči, dynamické programování DTW, skryté Markovovy modely HMM
  • Syntéza řeči
  • Software a knihovny pro zpracování řeči.

Cvičení odborného základu

2 hod., nepovinná

Vyučující / Lektor

Osnova

  • Paramatrizace, DTW, HMM.
  • Prezentace projektů.

Cvičení na počítači

12 hod., nepovinná

Vyučující / Lektor

Osnova

    V laboratořích (kromě poslední) je používán Matlab.
  • Rámce, okna, spektrum, předzpracování.
  • Lineární predikce (LPC).
  • Určování základního tónu.
  • Kódování.
  • Rozpoznávání - Dynamic time Warping (DTW).
  • Rozpoznávání - skryté Markovovy modely (Hidden Markov Model Toolkit - HTK).

Projekt

12 hod., nepovinná

Vyučující / Lektor