基于语义网的内容监管技术的研究

来源 :上海交通大学 | 被引量 : 0次 | 上传用户:ttklwoyaosha
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
随着互联网的日益普及和发展,其传播内容的健康性、安全性问题也日益突出,色情、暴力、反动等不良信息在互联网上随意传播,这严重危害了国家的安定和人民的身心健康。因此,对互联网实施有效的内容安全管理,需求迫切。就我国目前情况来看,媒体监管主要采用人工审核的方式,要耗费大量的人力物力,这不仅影响了互联网的开放性,而且,随着互联网爆炸式的发展,人工审核的方式也越来越不能适应内容监管的需要。 至今互联网都是作为一个供人使用的文件的载体而不是作为一个计算机可以理解的并能自动处理的数据与信息的载体而发展起来的。用面向计算机的数据来扩充网页,同时加入仅供计算机阅读和处理的文件,我们就把互联网变成了语义网。计算机跟踪通向关键术语的定义以及对这些术语进行逻辑推理的规则的超连接,就可以发现语义数据的意义。这样所得到的基础结构将促进自动化网上服务(如内容安全监管)的开发。 本文首先基于Web具有的一些特征以及应用于语义网的知识表示语言,比较了语义网中知识表示和传统知识表示的不同,提出了语义网知识表示的评价标准,界定了本体的概念并介绍了本体在知识表示中的应用。资源描述框架(RDF)内容标记规范讲的是从互联网内容监管和过滤的需求出发,应该如何来对内容进行标记,使计算机能够理解网络内容并对其进行自动处理。资源描述架构(RDF)是处理标记的基础,为在互联网上互相交换机器可理解数据的应用程序提供互操作性。 然后从监管需求和监管难度两方面阐述了内容监管模式研究的必要性。从网络的不同位置指出了几种可能的监管模式。分析了当前存在的两种监管手段,并从当前技术发展的成熟度考虑,倾向于使用基于内容标记的内容监管。在这之后详细阐述基于标记的内容监管方法。给出了以信息网关为中心的内容监管体系结构模型。 接着阐述了Web给数据挖掘带来的挑战,以及基于’Web的数据挖掘的方法。其中着重介绍了Web内容挖掘、结构挖掘、用法挖掘。 最后提出了一种利用多智能主体和本体论(ontology)理论设计的信息检索服务器。它集成了界面主体、预处理主体、管理主体、信息处理主体和具有移动性的信息搜集主体,并利用ontology对文档进行领域分类,同时对用户的查询信息进行规范。该系统能够比较及时地反映网络中信息的动态变化,并具有较好的信息导引能力。
其他文献
该论文主要围绕着国家自然科学基金重大计划项目——"宽带COFDM关键技术研究"的子项目——"多用户OFDM上行链路同步"来展开研究工作的.论文在深入分析OFDM基本原理基础上研究
入侵检测是最近10余年发展起来的一种动态的监控、预防或抵御系统入侵行为的安全机制.和传统的预防性安全机制比,入侵检测具有智能监控、实时探测、动态响应、易于配置和适用
该文针对通用Linux内核在实时性能上的诸多问题,充分利用有关实时操作系统的研究成果与实现方法,独创性地提出了一种分层资源内核(Hierarchical Resource Kernel)的调度框架,
认知无线电(Cognitive Radio, CR)是当今无线通信领域的研究热点,被认为有望从根本上解决目前静态频谱管理政策造成的频谱资源浪费。变换域通信系统(Transform Domain Communi
该文中所说的宽带接入网关用于提供驻地网到IP骨干网的接口,位于基于以太网的宽带接入网中的局侧设备的位置,需要实现报文转发,用户接入、认证,IP地址转换等功能.作为宽带接
该文主要讨论了MTS/COM+和Windows DNA的体系结构以及基于它的多层分布式应用系统的基本实现方法.在这个主题中还讨论了与应用系统整体性能密切相关的数据更新、线程模型、事
Reed-Solomn 码作为一种有强纠突发错误和随机错误能力的好码,在高可靠通信和数据存贮领域得到广泛的应用.但RS码的有限域的代数结构使得在大的域用硬件实现一直是工程应用的
该文主要是以减少低码重码字的个数为研究目标,对自结尾序列(特别是重2自结尾序列)的性质及它对Turbo码低码重分布的影响,Turbo码的迭代译码算法,S-交织器的倍距变换特性和改
多基线层析SAR是传统二维SAR成像技术的扩展。多基线层析SAR借鉴合成孔径原理,利用平台多次飞行在层析向上合成一个大孔径,从而实现目标高精度三维成像。与干涉SAR(InSAR)通
该文主要包括两大部分: 第一部分:简要介绍了扩频通信的基本理论,分析了传统的扩频序列的特性,在统计模拟分析了由Logistic映射产生的混沌序列相关性的基础上,说明了将混沌应