期刊文献+
共找到2篇文章
< 1 >
每页显示 20 50 100
自动构建基于电视剧字幕和剧本的日常会话基础标注库 被引量:1
1
作者 梁宇海 周强 《中文信息学报》 CSCD 北大核心 2020年第1期23-33,共11页
真实对话数据量不足已经成为限制数据驱动的对话生成系统性能提升的主要因素,尤其是汉语语料。为了获得丰富的日常会话语料,可以利用字幕时间戳信息把英语电视剧的英文字幕及其对应的中文字幕进行同步,从而生成大量的汉英双语同步字幕... 真实对话数据量不足已经成为限制数据驱动的对话生成系统性能提升的主要因素,尤其是汉语语料。为了获得丰富的日常会话语料,可以利用字幕时间戳信息把英语电视剧的英文字幕及其对应的中文字幕进行同步,从而生成大量的汉英双语同步字幕。然后通过信息检索的方法把双语同步字幕的英文句子跟英语剧本的演员台词进行自动对齐,从而将剧本中的场景和说话者信息映射到双语字幕中,最后得到含有场景及说话者标注的汉英双语日常会话库。该文利用这种方法,自动构建了包含978109对双语话语消息的接近人类日常会话的多轮会话数据库CEDAC。经过抽样分析,场景边界的标注准确率达到97.0%,而说话者的标注准确率也达到91.57%。该标注库为后续进行影视剧字幕说话者自动标注和多轮会话自动生成研究打下了很好的基础。 展开更多
关键词 日常会话语料 电视剧剧本解析 双语字幕同步 剧本和字幕的自动对齐
在线阅读 下载PDF
基于语音识别和语速修改的语音复读系统 被引量:2
2
作者 梁青青 杨鸿武 +1 位作者 郭威彤 裴东 《计算机工程》 CAS CSCD 北大核心 2011年第5期288-290,共3页
针对英语学习中的听力练习问题,利用语速修改算法和大词表连续语音识别算法,实现一个面向英语学习的语速可变、字幕同步的数字复读系统,根据字幕选择相应的语音进行复读,并实时调整语速。MOS评测结果表明,系统调节语速后的语音平均MOS... 针对英语学习中的听力练习问题,利用语速修改算法和大词表连续语音识别算法,实现一个面向英语学习的语速可变、字幕同步的数字复读系统,根据字幕选择相应的语音进行复读,并实时调整语速。MOS评测结果表明,系统调节语速后的语音平均MOS得分为4.1,接近原始语音质量。语音识别结果显示,系统对英语听力材料中纯净语音的识别率达到70.8%,能够满足英语听力学习的需要。 展开更多
关键词 语速调节 语音识别 字幕同步 语音复读
在线阅读 下载PDF
上一页 1 下一页 到第
使用帮助 返回顶部