ridm@nrct.go.th   ระบบคลังข้อมูลงานวิจัยไทย   รายการโปรดที่คุณเลือกไว้

New signal decomposition method based speech enhancement

หน่วยงาน สถาบันวิจัยและให้คำปรึกษาแห่ง มหาวิทยาลัยธรรมศาสตร์

รายละเอียด

ชื่อเรื่อง : New signal decomposition method based speech enhancement
นักวิจัย : Charturong Tantibundhit , Boston, J. Robert , Li, C. C. , Durrant, John D. , Shaiman, S. , Kovacyk, Kristie , El-Jaroudi, A.
คำค้น : Confusion matrix , univariate Gaussian , Modified speech , Psychoacoustic test , Residual component , Speech enhancement , Speech intelligibility , Speech perception , hidden Markov chain , HMC , maximum a posteriori , MAP , modified discrete cosine transform , MDCT , modified rhyme protocol , Viterbi algorithm , wavelet transform , Tonal component , Transient component
หน่วยงาน : สถาบันวิจัยและให้คำปรึกษาแห่ง มหาวิทยาลัยธรรมศาสตร์
ผู้ร่วมงาน : -
ปีพิมพ์ : 2550
อ้างอิง : Signal processing. 87,11 (2007) pp. 2607-2628 , 0165-1684 , http://dspace.library.tu.ac.th/handle/3517/4730
ที่มา : -
ความเชี่ยวชาญ : -
ความสัมพันธ์ : -
ขอบเขตของเนื้อหา : -
บทคัดย่อ/คำอธิบาย :

The auditory system, like the visual system, may be sensitive to abrupt stimulus changes, and the transient component in speech may be particularly critical to speech perception. If this component can be identified and selectively amplified, improved speech perception in background noise may be possible. This paper describes an algorithm to decompose speech into tonal, transient, and residual components. The modified discrete cosine transform (MDCT) was used to capture the tonal component and the wavelet transform was used to capture transient features. A hidden Markov chain (HMC) model and a hidden Markov tree (HMT) model were applied to capture statistical dependencies between the MDCT coefficients and between the wavelet coefficients, respectively. The transient component identified by the wavelet transform was selectively amplified and recombined with the original speech to generate modified speech, with energy adjusted to equal the energy of the original speech. The intelligibility of the original and modified speech was evaluated in eleven human subjects using the modified rhyme protocol. Word recognition rate results show that the modified speech can improve speech intelligibility at low SNR levels (8% at - 15 dB, 14% at - 20 dB, and 18% at - 25 dB) and has minimal effect on intelligibility at higher SNR levels. © 2007 Elsevier B.V. All rights reserved.

บรรณานุกรม :
Charturong Tantibundhit , Boston, J. Robert , Li, C. C. , Durrant, John D. , Shaiman, S. , Kovacyk, Kristie , El-Jaroudi, A. . (2550). New signal decomposition method based speech enhancement.
    กรุงเทพมหานคร : สถาบันวิจัยและให้คำปรึกษาแห่ง มหาวิทยาลัยธรรมศาสตร์ .
Charturong Tantibundhit , Boston, J. Robert , Li, C. C. , Durrant, John D. , Shaiman, S. , Kovacyk, Kristie , El-Jaroudi, A. . 2550. "New signal decomposition method based speech enhancement".
    กรุงเทพมหานคร : สถาบันวิจัยและให้คำปรึกษาแห่ง มหาวิทยาลัยธรรมศาสตร์ .
Charturong Tantibundhit , Boston, J. Robert , Li, C. C. , Durrant, John D. , Shaiman, S. , Kovacyk, Kristie , El-Jaroudi, A. . "New signal decomposition method based speech enhancement."
    กรุงเทพมหานคร : สถาบันวิจัยและให้คำปรึกษาแห่ง มหาวิทยาลัยธรรมศาสตร์ , 2550. Print.
Charturong Tantibundhit , Boston, J. Robert , Li, C. C. , Durrant, John D. , Shaiman, S. , Kovacyk, Kristie , El-Jaroudi, A. . New signal decomposition method based speech enhancement. กรุงเทพมหานคร : สถาบันวิจัยและให้คำปรึกษาแห่ง มหาวิทยาลัยธรรมศาสตร์ ; 2550.