基于三音子模型的语料自动选择算法

微信服务号

微信订阅号

2025年6月6日 0:27 星期五

首页 > 过刊浏览>2000年第11卷第2期 >271-276

基于三音子模型的语料自动选择算法
DOI:
                        
                    
CSTR:
                        
                    
作者:
                        吴华吴华
中国科学院自动化研究所模式识别国家重点实验室,北京,100080
在期刊界中查找
在百度中查找
在本站中查找
徐波徐波
中国科学院自动化研究所模式识别国家重点实验室,北京,100080
在期刊界中查找
在百度中查找
在本站中查找
黄泰翼黄泰翼
中国科学院自动化研究所模式识别国家重点实验室,北京,100080
在期刊界中查找
在百度中查找
在本站中查找

                    
作者单位:
作者简介:
通讯作者:
中图分类号:
基金项目:本文研究得到国家自然科学基金(No.69835030)资助.

Automatic Corpus Selecting Algorithm Based on Triphone Models

Author:

WU Hua
WU Hua

在期刊界中查找
在百度中查找
在本站中查找
XU Bo
XU Bo

在期刊界中查找
在百度中查找
在本站中查找
HUANG Tai-yi
HUANG Tai-yi

在期刊界中查找
在百度中查找
在本站中查找

Affiliation:

Fund Project:

摘要

图/表

访问统计

参考文献

相似文献

引证文献

资源附件

文章评论

摘要:

在语音识别中,如何经济地挑选语音训练语料,使其覆盖尽可能多的语音现象是一个非常重要的问题.传统的语音训练语料采用手工挑选后再进行检验和补充的方法,此方法难以保证所选语料语音现象的覆盖率.该文提出了一种自动地从大规模语料库中挑选语料的搜索算法,此算法不但能使所选语料覆盖几乎所有语音现象,而且能保证训练语料中三音子和类三音子有足够的样本个数,使训练数据不过于稀疏,为训练正确而可靠的语音模型打下了坚实的基础.

关键词:语音识别,模型训练,三音子,类三音子.

Abstract:

In speech recognition,the selection of training corpus for robust acoustic modeling which can cover almost all phone phenomena is very important.Traditionally,corpus is selected manually first,and then tested and supplemented,which can't provide sufficient coverage of samples for various statistical modeling methods.An algorithm for automatically selecting the training samples from large-scale text corpus is developed in this paper.This algorithm can not only cover almost all phone phenomena but also ensure to include ideal samples of triphones or class-triphones and ensure enough data for training,which makes it possible to train acoustic model reliably.

Key words:Speech recognition,model training,triphone,class-triphone.

引用本文

吴华,徐波,黄泰翼.基于三音子模型的语料自动选择算法.软件学报,2000,11(2):271-276

复制

文章指标

点击次数:
下载次数:
HTML阅读次数:
引用次数:

历史

收稿日期:1999-01-07
最后修改日期:1999-03-18
录用日期:
在线发布日期:
出版日期:

微信服务号

微信订阅号

引用本文

相关视频

分享

文章指标

历史

文章二维码

微信服务号

微信订阅号

引用本文

相关视频

分享

微信扫一扫：分享

文章指标

历史

文章二维码