首页 | 本学科首页   官方微博 | 高级检索  
     

广播语音的音频分割
引用本文:贾磊,穆向禺,徐波.广播语音的音频分割[J].中文信息学报,2002,16(1):38-43.
作者姓名:贾磊  穆向禺  徐波
作者单位:中国科学院自动化所,模式识别国家重点实验室
基金项目:国家自然科学基金重点项目 (6 9835 0 0 3),国家“973”项目 (G19980 30 5 0 4 )
摘    要:本文的广播电视新闻的分割系统分为三部分:分割、分类和聚类。分割部分是采用本文提出的基于检测熵变化趋势的分割算法来检测连续语音音频信号的声学特征跳变点,从而实现不同性质的音频信号的分割。这种检测方法不同于传统的需要门限的跳变点检测方法,它是以检测一定窗长的信号内部的每一个可能的分割点所分割的两段信号的信号熵的变化趋势来检测音频信号声学特征跳变点的,可以避免由于门限的选择不当所带来的分割错误。分类部分是采用传统的基于高斯混合模型(GMM)的高斯分类器进行分类,聚类部分采用基于矢量量化(VQ)的说话人聚类算法进行说话人聚类。应用此系统分割三段30分钟的新闻,成功的实现了连续音频信号的分割,去除掉了所有的背景音乐,以较高的精度把属于同一个人的说话语音划归为一类,为广播语音的分类识别打下了良好的基础。

关 键 词:广播语音的音频分割  声学特征跳变点检测  基于BIC准则的声学特征跳变点检测  熵变化趋势  

Broadcasting Segmentation
JIA Lei,MU Xiang,yu,XU Bo.Broadcasting Segmentation[J].Journal of Chinese Information Processing,2002,16(1):38-43.
Authors:JIA Lei  MU Xiang  yu  XU Bo
Affiliation:National Laboratory of Pattern Recognition ,Chinese Academy of Sciences
Abstract:Speaker change point detection based on BIC criterion is the most widely used method in speaker change detection in broadcasting segmentation.Although the author asserts that this method is free from threshold,the BIC value of a change point must above 0 is too strict for some short utterance.Because speakers are different from each other,the BIC value of two different speakers is spread over a large range in our test.In this paper,a speaker change detection method based on entropy changing trend is used to locate the change point in a sliding window with definite length.The entropy change trend is tested for every hypothesized speaker change point in the window.By this change trend detection,the threshold is avoided successfully,which makes the proposed speaker change detection method is possible for the detection of different kinds of speaker change and the speaker change of the short utterance.
Keywords:broadcasting segmentation  speaker change detection  BIC criterion  Entropy change trend  
本文献已被 CNKI 维普 万方数据 等数据库收录!
点击此处可从《中文信息学报》浏览原始摘要信息
点击此处可从《中文信息学报》下载全文
设为首页 | 免责声明 | 关于勤云 | 加入收藏

Copyright©北京勤云科技发展有限公司  京ICP备09084417号