首页> 中文期刊>中文信息学报 >可扩展的网页关键信息抽取研究

可扩展的网页关键信息抽取研究

     

摘要

该文提出了一种可扩展的网页关键信息抽取框架.该框架很好地融合了模板无关的全自动信息抽取算法和基于模板的信息抽取算法,从本质上提高抽取精度和抽取效率.该框架中的一些关键环节可根据需求进行替换,因此该框架具有很好的可扩展性.同时,该文还提出了模板的正交过滤算法.将该算法引入基于模板的抽取算法中,能够从本质上提高生成的模板的准确性.实验结果验证了上述结论.

著录项

相似文献

  • 中文文献
  • 外文文献
  • 专利
获取原文

客服邮箱:kefu@zhangqiaokeyan.com

京公网安备:11010802029741号 ICP备案号:京ICP备15016152号-6 六维联合信息科技 (北京) 有限公司©版权所有
  • 客服微信

  • 服务号