摘要: 采用增减特征分量的方法研究了MFCC各维倒谱分量对说话人识别和语音识别的贡献。使用DTW测度,在标准英文数字语音库上的实验表明,最有用的语音信息包含在MFCC分量C1到C12之间,最有用的说话人信息包含在MFCC分量C2到C16之间。MFCC分量C0和C1包含有负作用的说话人信息,将其作为特征会引起识别率的降低。低阶MFCC分量较高阶分量更容易受加性噪声和卷积噪声干扰。
中图分类号:
甄斌,吴玺宏,刘志敏,迟惠生. 语音识别和说话人识别中各倒谱分量的相对重要性[J]. 北京大学学报(自然科学版).
ZHEN Bin,WU Xihong,LIU Zhimin,CHI Huisheng. On the Importance of Components of the MFCC in Speech and Speaker Recognition[J]. Acta Scientiarum Naturalium Universitatis Pekinensis.