基于模板的网页信息抽取技术研究
杨一柳
渤海大学 大学计算机教研部,辽宁 锦州,121013
摘要:准确挖掘网页中的信息对检索系统非常重要。提出了一种基于模板的网页信息抽取方法进行网页信息抽取。该方法采用网页抓取与数据模板技术实现了网页信息的自动发现与抽取。在Yahoo网站上的实验结果表明,该方法具有较好的检索效果。
关键词:模板信息抽取网络爬虫
分类号:TP39(计算技术、计算机技术)
论文发表日期:2013-01-01
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:4( 320-322,327 )
英文信息展开
渤海大学学报(自然科学版)

渤海大学学报(自然科学版)

CSTPCD
ISSN:1673-0569
年,卷(期):2013,(3)
所属栏目:信 息 科 学