机器翻译系统及相关技术评测的研究

来源 :哈尔滨工业大学 | 被引量 : 0次 | 上传用户:linlongbin
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
随着机器翻译的发展,机器翻译评价也越来越受到重视.机器翻译评价是一项复杂的研究课题,最主要的困难在于评价指标的确定.如何评价一个机器翻译系统好与坏,如何在多个翻译系统中评价出哪个更好,这都需要一个全面的、客观的评价体系.人工评价往往带有主观性,同时又费时费力,所以能否找到一个可行的自动机器翻译评价方法是机器翻译评价研究的发展方向.该文对机器翻译系统采用了白箱测试方法,评测主要以自动的方式实现.文中涉及到了分词及词性标注的评测、句法分析评测和译文质量评测.在分词及词性标注评测部分共对3个系统进行了分词、未登录词识别、歧义字段识别及词性标注评测.评测参考国家863中文与接口技术评测活动中的分词评测标准,评测指标除采用标准的正确率、召回率及调和平均数外,还增加了一些新的评测指标.分词评测增加了可接受性指标,增加这个指标可使评测结果更合理,但这个指标难以实现自动评测.考虑到分词结果对词性标注的影响在词性标注评测中增加了一个相对正确率的评测指标.另外,在对多个不同的词性标注系统进行评测时,使用了一个最小的词性标注集,将每个系统的标注集都映射到这个最小的标注集上,这样才能评测出不同系统的词性标注结果.在句法分析评测部分从基本短语识别和句子级短语分析两个方面评测,评测指标采用了正确率、召回率和调和平均数三个评测指标,详细地对每类短语分析的结果进行评测.译文质量评测主要依据成熟的BLEU标准,对汉语译文质量进行自动评测.根据汉语的特点,在使用BLEU标准评测时分别以字和词为模型进行评测.实验结果证明,采用词模型的一元关系的评测比采用字模型的一元和二元关系的评测更接近人工评测结果.
其他文献
Primary-Backups机制是设计容错计算机系统的重要方法,Primary-Backups机制的研究对于容错计算机系统的研制具有重要的理论和实践意义.该文系统性的研究如何把Primary-Backup
在现代社会中,名片作为一种简单、美观的个人信息载体使用的越来越频繁.名片的大量使用在给人们带来便利的同时,也带来了一些问题,大量名片的存储、查询、输入等问题都需要解
高技术战争条件下,地理信息系统(GIS)被广泛应用到军事领域,己成为现代化军事战争的一项重要内容.因此,开发拥有自主知识产权的军事GIS系统平台,研究和掌握GIS中的前沿关键技
Internet蠕虫频繁的大规模爆发,已经对网络安全产生了巨大威胁.建立路由器级蠕虫扩散仿真平台对于掌握蠕虫扩散的过程与特点,研究蠕虫的检测与遏制方法具有重要意义.该文提出
本文结合海洋地震并行处理平台的开发,将面向对象技术应用于实际的编程.第一部分:主调度程序,负责对所有子系统的调度,启动各子系统并向子系统传递所需的参数.第二部分:数据
移动Ad hoc网络使得用户"随时随地(Anywhere,Anytime)"都具备网络能力,具有传统有线网络无法替代的优势,在许多军事和民用事业中有着广阔的发展前景.由于移动Ad hoc网络中的
蛋白质的研究是生命科学研究的基础和重大核心问题之一。对于蛋白质结构的研究,一直是热门的课题。研究蛋白质的功能要深入了解它们的结构,特别是空间结构,因为结构决定功能。生
学位
随着各种高性能移动终端设备的涌现,通信技术和互联网技术的相互渗透,移动性已经成为因特网发展的内在要求。移动IP技术为这两大技术的最终融合奠定了基础。但是基本移动IP协议
随着软件规模的日益扩大,软件系统的复杂性不断增加,传统的软件可靠性设计在实际的应用中存在的问题愈显不足。具备自适应地处理资源变化、用户需求改变和系统故障的能力成为保