首页> 中文会议>全国第六届计算语言学联合学术会议 >基于规则和非规则方法的WEB信息提取

基于规则和非规则方法的WEB信息提取

页面导航

摘要
著录项
相似文献
相关主题

摘要

互联网上的各个信息源是相互独立的.如果一个系统能够把关于某个主题的来自各个信息源的信息集成到一个完全的信息源中,用户就能方便地获得这个主题他(她)所需的最想要的或者全部的信息.该系统中最重要的一个部分就是从网页中提取指定的信息.本文以网上书店为例详细介绍了web页面信息提取的实现.网页中一些信息可以采用基于正则表达式的规则提取,然而也有一类信息很难用规则提取,例如书名.对这些信息,我们采用了基于字体、距离等非语言启发信息的非规则方法提取,试验获得了比较好的结果.以网上书店为例,采用非规则的方法使书名提取的F值提高了31个百分点.

著录项

来源
《全国第六届计算语言学联合学术会议》|2001年|386-392|共7页
会议地点太原
作者
黄晓宏; 连理; 夏迎炬; 徐国伟;
展开▼
作者单位

中国中文信息学会;

中国计算机学会;

展开▼
会议组织
正文语种
原文格式 PDF
中图分类信息处理（信息加工）;
关键词
WEB信息集成; WEB信息提取;

相似文献

中文文献
外文文献
专利

1. 基于规则面向对象的遥感影像分类方法在信息提取中的应用 [J] . 杨维超 . 世界有色金属 . 2020,第007期
2. 基于规则提取量的Web日志关联规则挖掘方法 [J] . 符保龙 . 计算机应用研究 . 2010,第002期
3. 一种面向语义Web浏览器的基于规则的推理方法 [J] . 龚赛赛 ,葛唯益 . 南京师范大学学报（工程技术版） . 2011,第004期
4. 基于规则替换法的多源遥感数据地表覆盖信息提取 [J] . 于欢 ,孔博 ,杨德生 . 国土资源遥感 . 2011,第004期
5. 基于规则的Ei Web中国作者检索公式及其策略研究 [J] . 吴亚艳 ,袁丽芬 . 农业图书情报学刊 . 2012,第005期
6. 基于规则的WEB文本信息抽取平台设计与实现 [C] . 朱义 ,邢春晓 ,黄梦醒 . 第十二届全国少数民族语言文字信息处理学术研讨会 . 2009
7. 基于规则的Web文本信息抽取技术的研究 [A] . 李向春 . 2011

基于规则和非规则方法的WEB信息提取

摘要

著录项

相似文献

相关主题

期刊订阅