论文部分内容阅读
“国家医药卫生科学数据共享网数据集分类与编码研究”是国家医药卫生科学数据共享(National Medical Scientific Data Sharing,NMSDS)工程建设子项目—“标准化体系建设”的基本内容之一,是NMSDS共享工程数据类通用标准的研究内容之一。本课题旨在结合领域实际,探讨NMSDS数据集分类与编码,为《医药卫生科学数据分类与编码方案》标准的制定提供依据。 长期以来,医药卫生领域积累了海量的科学数据,数据来源广泛,具体包括①各业务部门通过长期观察、监测、检测、调查、试验和实验等获取的具有连续性和系统性积累的原始数据;②国家长期布局获取的公益性科学数据资源;③医药卫生领域重要的历史资料;④科学研究计划项目所产生的科学数据资源;⑤根据需求,基于已有业务信息系统和国内外各类基础数据资源开展的应用设计、二次开发、深加工和多源复合数据产品的加工,开发具有资源附加属性的数据集产品。但是,这些科学数据资源缺乏系统化的归纳、层次化的标识和规范化的表达。如何将具有某种共同特征的数据归并在一起,然后设定某种符号体系进行编