【摘 要】
:
本文以提高合成语音自然度为研究背景,以语句韵律层级的手动标注提供理论依据为目标,首先定义了维吾尔语韵律和层级,收集整理了一套适合于现代维吾尔语句子韵律层级
【机 构】
:
新疆多语种信息技术重点实验室新疆师范大学文学院,乌鲁木齐,830054新疆多语种信息技术重点实验室新疆大学信息科学与工程学院,乌鲁木齐,830046
【出 处】
:
第三届全国少数民族青年自然语言信息处理、第二届全国多语言知识库建设联合学术研讨会
论文部分内容阅读
本文以提高合成语音自然度为研究背景,以语句韵律层级的手动标注提供理论依据为目标,首先定义了维吾尔语韵律和层级,收集整理了一套适合于现代维吾尔语句子韵律层级划分的规则和方法包括句子成分分析法、词组分析法、助词分析法、独立成分分析法等;筛选了40630个典型文本句子,并进行了各韵律层级的人工标注。为了验证其可靠性,聘请了专业播音员录制1497个句子,对比了文本句子手动标注与语音句子的听觉标注结果。实验结果表明,本文规则切实可行,为研发各韵律层级的自动预测算法提供了规则依据。
其他文献
随着标签作为web2.0时代一种重要的资源描述方式引起了人们极大的重视。本文主要分析了中文博客网站标签的标注情况,包括标签分类、热门标签、命名实体、网络流行语
事件信息抽取是自然语言处理中一个较新的领域,汉语方面还有很大的研究空间。本文提出了一个以完整突发事件文本为处理对象的事件信息抽取策略。目前语义角色的识别
这篇论文介绍了一个新颖的关键词组提取方法。该方法使用了LDA模型。方法通过LDA模型来获得文档的主题信息,通过将这些信息与其它特征信息整合起来,给短语进行了打分,
本文提出了一种用语义标签、语义指纹来表示关联语义知识的形式化方法,其中语义标签指代语义中的一个知识单元(也即概念),语义指纹是对语义标签所指代概念的描述,由语
人物属性抽取是人名搜索引擎和社会关系网络构建的重要基础。本文提出了一种从维基百科中自动获取人物属性的方法。该方法利用人物类维基文本现有信息盒中的“人物
通用口语语料库由于自身结构和数据冗余的原因,难以和口译教学实践相结合,外语教师可以自建小型口译教学语料库以辅助口译教学。本文从语料选取、标注工具制作和语料
目前我国大学英语师资和在校学生数量比例失调情况严重。参考教育部高教司最新颁布的《大学英语课程教学要求》,新一轮大学英语改革的核心任务是要建立一个“基于计
@@当前,关于句法语义的研究正方兴未艾,形成了一个新的热点和亮点。但是,具体的专题性研究比较多,而有关的理论问题却还没有引起大家充分的重视。特别是语法形式与语法
普通话水平测试评分细则是《普通话水平测试大纲》评分系统的操作性文本,是测试现场操作的重要依凭。本评分细则研究在《普通话水平测试大纲》修订和《普通话水平测
@@1985年,陆俭明、马真两位先生提出了一个在汉语对外教学实践中的语法疑难问题,即为什么成语“合情合理”跟“偏听偏信”会在如下的句法环境中形成对立。