首页> 中文期刊> 《计算机研究与发展》 >基于文本挖掘的精子发生各阶段的相关基因/蛋白名称提取

基于文本挖掘的精子发生各阶段的相关基因/蛋白名称提取

         

摘要

精子发生是雄性哺乳动物生命活动中一个重要的生物学过程,该过程的每一个阶段都有众多基因/蛋白参与并发挥功能.相关基因/蛋白出现异常是导致男性不育症的主要诱因,但这些基因/蛋白的信息大都分散在科研文献中,而人工从海量文献中提取这些基因/蛋白名称费时费力,因此,基于文本挖掘技术,提出了自动提取精子发生过程各个阶段中发挥作用的基因/蛋白名称的策略.首先比较了3种不同算法在不同词条数目下的分类效果,并确定用支持向量机(support vector machine,SVM)算法对相关文本按照精子发生过程的3阶段分类,然后建立适当的信息提取和筛选方法,从文献摘要中提取每个阶段中的基因/蛋白名称.最后,通过与人工提取的基因/蛋白名称进行比较验证,提取结果的正确率为71.9%,证明了提取策略的可行性.

著录项

相似文献

  • 中文文献
  • 外文文献
  • 专利
获取原文

客服邮箱:kefu@zhangqiaokeyan.com

京公网安备:11010802029741号 ICP备案号:京ICP备15016152号-6 六维联合信息科技 (北京) 有限公司©版权所有
  • 客服微信

  • 服务号