【摘 要】
:
语言知识库是自然语言处理系统不可或缺的组成部分,语言知识库的规模和质量在很大程度上决定了自然语言处理系统的成败.这已经成为自然语言处理技术研究者和系统开发者的共识
【机 构】
:
北京大学计算语言学研究所,北京,100087
【出 处】
:
中国中文信息学会二十五周年学术会议
论文部分内容阅读
语言知识库是自然语言处理系统不可或缺的组成部分,语言知识库的规模和质量在很大程度上决定了自然语言处理系统的成败.这已经成为自然语言处理技术研究者和系统开发者的共识,语言知识库的内容及其知识表达形式是多种多样的.
其他文献
本文分析了当前国内语音语料标注结果的存储结构的局限,不但从理论上分析了关系型数据库在设计语音语料库存储结构方面的优势,提出了离散型语音语料库和集中型语音语料库这两
阿齐沙坦是新型血管紧张素 Ⅱ受体拮抗药(ARB),与其他 ARB类药物相比,具有选择性高、降压效果显著、安全性高、耐受性好、不良反应少和心脑血管保护等优点,可单用或者与其他
本文描述了一套面向Web基于XML的开放式中文语言处理平台,命名为"语言技术平台LTP".LTP包含5项主要内容:语言技术置标语言LTML、基于DOMTree的一套DLL模块、一套可视化工具、
读过普通化学的人,都知道有元素的週期表(Periodic table)。週期表把错综复杂的元素,排列成为有系统的表式,很明晰地加以分类,这对于近代化学的进展,无疑的有很重要的贡献。
文字符号的极限熵是在充分考虑上下文信息条件下,字符所包含平均信息量的大小.本文分别利用两种统计方法来估计汉字的极限熵:第一种方法通过计算汉字的n阶熵来逼近极限熵;第
解放军第十一医院创建于1946年,经过半个多世纪的艰苦创业,现已发展成集医疗、预防、教学、科研、康复为一体,环境优雅、设备先进、特色明显、技术力量雄厚的综合性二级甲等医院
中文输入法是中文信息处理的基础软件.本文针对现有输入法很少考虑利用候选词语本身特性来进行排序的情况,给出了将输入法词库进行类别标注以及在输入法系统中集成分类引擎的
藏文字符集标准发布较晚,导致目前使用的藏文编码多种多样.本文按编码所属体系分类介绍了26种藏文编码,讨论了藏文编码转换中的关键问题,介绍了藏文结构特点和统计学特征,介
一个能够满足拼音识字教学要求的"汉字编码系统",它使用统一的拼写代码,共同的编码模式;同一系列编码之间,能够相互演化.它将字词的基本属性全面描述,实现"教学用码"与"社会
随着农业合作化的加速完成、手工业和资本主义工商业的社会主义改造的提前实现,在全国范围内,一个空前的文化高潮就要到来。周总理在人民政协第二届全国委员会第二次全体会