期刊界 All Journals 搜尽天下杂志传播学术成果专业期刊搜索期刊信息化学术搜索

1.

高明黄哲学《集成技术》2012,1(3):47-54

随着Deep Web数量和规模的快速增长,通过对其发起查询请求以得到存储在后台数据库中的相关信息,日渐成为用户获取信息的主要方式。为了方便用户有效地利用Deep Web中的信息,越来越多的研究者致力于这一领域的研究,重点之一是Deep Web后台数据库的数据集成。由于Deep Web后台数据库存储的主要是文本信息,使得从文本处理角度出发,针对Deep Web中存储的内容进行查询与检索的研究具有十分广阔的应用前景。本文对Deep Web的研究现状进行了较为详细的分析,同时对研究的发展方向进行了展望。相似文献

2.

基于整体模式匹配的深度网集成系统的研究

邵秀丽孙杰侯乐彩《计算机工程与设计》2011,32(8):2679-2683

为通过一个统一的接口访问所有分布的Web数据源,获得质量优结构好的信息,设计实现了包括Deep Web查询接口模式抽取、应用整体模式匹配算法的Deep Web查询接口模式匹配以及包含包括属性选择,表单元素生成和元素值域生成工作的查询接口集成3部分在内的基于整体模式匹配Deep Web集成系统.将该系统在Deep Web图书搜索系统中实际应用,运行结果表明,该系统设计是可行和有效的. 相似文献

3.

基于结果模式的Deep Web数据集成

马安香张斌张引高克宁孙达明《小型微型计算机系统》2010,31(5)

Deep Web中蕴含了海量可供访问的信息,如何构建一个具有较好适用性和高效数据处理能力的Deep Web数据集成系统是有效利用Deep Web信息的关键.提出一种基于结果模式的Deep Web数据集成机制,通过结果模式可以实现高效的数据抽取,并且在结果模式的基础上可以根据用户查询请求动态生成结果输出模式,为高效的查询结果处理奠定了良好基础;同时,针对Deep Web数据源特点,给出数据源间冲突的分类及解决策略,为解决数据源间的异构问题奠定了良好基础. 相似文献

4.

基于Deep Web的图书搜索引擎系统设计

都艺兵林培光《计算机与数字工程》2009,37(9):105-106

针对网上众多图书购物网站不提供面向同类网站的集成搜索和价格比较的问题,基于Deep Web技术实现了一个面向图书领域的图书搜索引擎系统。给出了系统实现的具体框架,探讨了如何对领域内各种异构数据库信息进行抽取、整合。实际运行表明该系统达到了预期效果。相似文献

5.

Deep Web数据集成专刊前言

孟小峰于戈《软件学报》2008,19(2):177-178

随着World Wide Web的飞速发展,出现了越来越多的可以在线访问的数据库,我们把这些数据库称作Web数据库.据统计,目前Web数据库的数量已经超过了45万个,在此基础上构成了Deep Web.Deep Web蕴含了大量有用的信息,其价值远远超过了仅由网页构成的Surface Web.但由于对Web数据库的访问只能通过其提供的相似文献

6.

基于Deep Web数据集成技术的信息查询系统设计

胡洋张水平黄聪会周二虎《计算机与信息技术》2009,(3)

根据Deep Web数据集成原理,提出了基于Deep Web数据集成技术的信息查询系统设计方案,并通过在图书和课件检索领域的实验证明了系统的可行性和有效性。相似文献

7.

Deep Web数据集成中基于最小超集的查询转换

姜芳艽贾琳琳孟小峰《计算机研究与发展》2007,44(Z3):23-28

近年来,随着Web上在线数据库的大量涌现,Deep Web数据集成(即Web数据库集成)成为当前信息领域的一个研究热点.查询转换是其中的核心部分,它主要负责将集成接口上的查询转换到相关Web数据库的接口上.由于Web数据库具有异构性和自治性的特点, 各查询接口上的属性名、数据格式以及查询能力都不尽相同,因此相当一部分查询不能进行精确转换,那么选择何种策略进行近似查询转换是一个很具有挑战性的工作.对这一问题进行了深入探讨,提出了基于最小超集的近似查询转换方法.实验结果表明,该方法在Deep Web数据集成中可以有效地提高返回结果的准确性. 相似文献

8.

面向旅游领域的Deep Web接口查询研究

白鹤赵志强王劲林《微计算机信息》2010,(13)

Deep Web蕴涵丰富的分类信息,是融合型在线旅游业务良好的数据源。本文对Deep Web接口模式进行分析,提出了接口集成方案的流程和领域实例库的建模方法,并就酒店查询业务进行了对方案的评估。测试结果显示,在对接口页面一定积累的基础上,可以达到较高的模式匹配准确率,从而保证了Deep Web接口的正确的自动查询。相似文献

9.

Deep Web数据集成中查询处理的研究与进展 总被引：2，自引：0，他引：2

姜芳艽孟小峰《计算机科学与探索》2009,3(2):113-129

随着Web上在线数据库的大量涌现,Deep Web数据集成成为当前信息领域的一个研究热点,而查询处理是其中的一个重要的组成部分。由于Web数据库具有规模大、自治性、异构性以及动态性等特点,使得Deep Web数据集成中的查询处理比传统的分布环境下的查询处理更具挑战性。围绕Deep Web数据集成中查询处理的三个关键研究点:模式匹配、Web数据库的选择以及查询转换,综述了近年来国际上相关的、具代表性的研究成果,分析了这些方法的优缺点,总结并展望了未来的发展方向。相似文献

10.

基于移动Agent的Deep Web数据集成研究

袁靓王小玲潘泽波《微计算机信息》2008,24(18)

对Deep Web中的海量信息进行集成是Web信息检索领域的一个新兴研究热点.本文提出了一个基于移动Agent的Deep Web数据集成框架,设计了数据集成中间件DWDIM(Deep Web Data Integration Middleware),采用Java语言和Aglet平台对集成系统进行实现.并将控制学中的负反馈技术引入到系统设计当中,提高了集成系统的性能. 相似文献

11.

一个Web查询界面域序列模式图模型及其应用

郭文宏范学峰《计算机科学》2009,36(4):218-220

针对Deep Web查询界面集成问题,定义了一种面向专门领域的域序列模式图(FSRG)模型,用于表示和发现同一领域查询界面中的所有域序列模式.该模型将领域内不同查询页面的域序列模式统一到一个有向有环图中.基于序列模式图进行研究可发现领域模式中域的结构化组织排列规律.还论述了域序列模式图的构造、域子序列模式划分和领域所有域的整体序列模式发现方法.在有限领域下封闭测试表明,该模型及其算法对结构化Web界面分析有较大应用价值.研究为实现智能化的Web数据模式处理提供了域序列分析方法,对大规模智能集成和搜索应用有一定参考价值. 相似文献

12.

中文深度万维网数据库的现状研究

刘玉奎周立柱范举《计算机学报》2011,34(2):360-370

深度万维网(Deep Web)已成为万维网上十分重要的资源,是数据库领域的研究热点.目前已有的多数研究主要集中在深度万维网发现、查询接口集成以及查询结果处理等技术层面.然而对于这个超出表面万维网所涵盖信息数百倍的宝贵资源,人们目前还缺乏足够的了解和认识.对于一些基本问题,例如:(1)中文深度万维网的具体规模有多大;(2... 相似文献

13.

一种Deep Web查询结果的实体抽取方法

赵海霞李道申刘勇赵嘉诚《计算机工程与应用》2012,48(36):160-163

Deep Web中蕴含着丰富的高质量的信息,通过Deep Web集成查询接口可以获取到包含这些信息的结果页面,因此,Deep Web查询结果页面的数据抽取成为Deep Web数据集成的关键。提出了将索引方法和编辑相似度相结合的方法,来完成Deep Web查询结果页面的数据抽取工作。大量实验结果表明:该方法是可行的,并且能够提高Deep Web数据实体抽取的准确性和召回率。相似文献

14.

DeepWeb信息集成系统中查询转换

王兵 ;刘彩虹《微机发展》2008,(7):176-180

随着Internet信息的迅速增长,许多Web信息已经被各种各样的可搜索在线数据库所深化,并被隐藏在Web查询接口下面。传统的搜索引擎由于技术原因不能索引这些信息——DeepWeb信息。由于DeepWeb惟一“入口点”是查询接口,为使查询接口自动产生有意义有查询,给出了DeepWeb信息集成系统框架,提出了基于数据类型的搜索驱动的用户查询转换方法,基于此设计并实现了一个针对中文DeepWeb信息集成原型系统。通过在实际DeepWeb站点上的实验证明了此方法是非常有效的。相似文献

15.

基于《知网》的中文Deep Web模式匹配算法研究 总被引：1，自引：1，他引：0

金玉范学峰《计算机应用研究》2009,26(10):3750-3753

随着数据库在Internet中的应用日益广泛,Deep Web集成（即Web数据库集成）成为当前信息领域的研究热点,模式匹配是Deep Web查询接口集成中的一个关键问题。目前大多数这方面的研究都是基于英文的,针对这种情况,探讨了中文Deep Web查询接口的模式匹配方法,并提出了一种基于《知网》、面向中文语义的模式匹配算法,并利用属性在查询接口上的相对位置信息解决语义冲突。手工收集查询表单对算法进行验证,实验表明该方法能使得接口之间属性匹配的正确率达到90 %以上。相似文献

16.

频繁项集在Deep Web数据源聚类中的应用

张蓬飞朱群雄《计算机工程与应用》2012,48(14):152-157

在Deep Web页面的背后隐藏着海量的可以通过结构化的查询接口进行访问的数据源。将这些数据源按所属领域进行组织划分,是DeepWeb数据集成中的一个关键步骤。已有的划分方法主要是基于查询接口模式和提交查询返回结果,存在查询接口特征难以完全抽取和提交数据库查询效率不高等问题。提出了一种结合网页文本信息,基于频繁项集的聚类方法,根据数据源查询接口所在页面的标题、关键词和提示文本,将数据源按照领域进行聚类,有效解决了传统方法中依赖查询接口特征以及文本模型的高维性问题。实验结果表明该方法是可行的,具有较高的效率。相似文献

17.

Deep Web查询接口研究

钱程阳小兰《计算机与现代化》2012,(6):161-164,168

Deep Web查询接口是Web数据库的接口,其对于Deep Web数据库集成至关重要。本文根据网页表单的结构特征定义查询接口;针对非提交查询法,给出界定Deep Web查询接口的一些规则;提出提交查询法,根据链接属性的特点进行判断,找到包含查询接口的页面;采用决策树C4.5算法进行分类,并用Java语言实现Deep Web查询接口系统。相似文献

18.

一种Deep Web爬虫爬行策略

下载免费PDF全文

刘徽黄宽娜余建桥《计算机工程》2012,38(11):284-286

Deep Web包含丰富的、高质量的信息资源,由于没有直接指向Deep Web页面的静态链接,目前大多搜索引擎不能发现这些页面,只能通过填写表单提交查询获取。为此,提出一种Deep Web爬虫爬行策略。用网页分类器的分层结果指导链接信息提取器提取有前途的链接,将爬行深度限定在3层,从最靠近查询表单中提取链接,且只提取属于这3个层次的链接,从而减少爬虫爬行时间,提高爬虫的准确度,并设计聚焦爬行算法的约束条件。实验结果表明,该策略可以有效地下载Deep Web页面,提高爬行效率。相似文献

19.

基于启发式信息的Deep Web结果模式获取方法*

李明李秀兰《计算机应用研究》2011,28(8):3026-3029

获取模式信息是深入研究Deep Web数据的必要步骤,针对Deep Web结果模式结构信息的丢失问题,提出了一种基于启发式信息的Deep Web结果模式获取方法.通过解析Deep Web结果页面数据,利用启发式信息为结果页面数据添加正确的属性名,进而得到对应Deep Web的结果模式,并对其进行规范化处理,解决不同数据... 相似文献