节点文献

基于深度优先判定聚类的DNA序列模体发现

DNA Sequences Motif Discovery Based on DFD Clustering

  • 推荐 CAJ下载
  • PDF下载
  • 不支持迅雷等下载工具,请取消加速工具后下载。

【作者】 何红洲周明天

【Author】 HE Hongzhou 1,2,ZHOU Mingtian 1 1.School of Computer Science and Engineering,University of Electronic Science & Technology,Chengdu 611731,China;2.College of Mathematics & Computer Science,Mianyang Normal University,Mianyang,Sichuan 621000,China

【机构】 电子科技大学计算机科学与工程学院绵阳师范学院数学与计算机科学学院

【摘要】 提出一种数据挖掘方法 MMHC来求解DNA序列模体。首先使用基于种子的错配聚类形成候选模体类,然后使用基于相对熵及聚类复杂度的深度优先判定(depth first determination,DFD)算法识别真正的模体类,最后使用保守区扫描法(conservation region scanning,CRS)及最大后验概率保值过滤法(MAP value-preservation filtering,MVPF)优化模体类。在两类DNA序列数据集上,将MMHC与三种经典的模体发现方法 MEME、AlignACE和SOMBRERO进行了对比试验。结果表明:对于大多数数据集,MMHC方法无论是在发现模体的可靠性及准确性方面,还是在反映背景种类的聚类结构方面,都明显优于三种经典的模体发现方法。

【Abstract】 A data mining method MMHC was given to solve DNA sequences motifs.The seed-based mismatch clustering was used to form the candidate motif clusters.Then the depth first determination(DFD) algorithm based on relative entropy and cluster complexity was proposed to identify the true motif clusters.Finally,the conservation region scanning(CRS) and MAP value-preservation filtering(MVPF) were given to optimize motif clusters.The experiment was conducted by testing MMHC method and comparing its performance with other three classic motif discovery methods MEME,AlignACE and SOMBRERO on two classes of DNA sequences datasets.Experimental results show the superiority of MMHC method over the three classic motif discovery methods in reliability,precision and the reflection of the cluster structure of the background species for most of the DNA sequences datasets.

【基金】 四川省教育厅自然科学研究项目(12ZB070)~~
  • 【文献出处】 生物物理学报 ,Acta Biophysica Sinica , 编辑部邮箱 ,2013年05期
  • 【分类号】TP18
  • 【下载频次】78
节点文献中: 

本文链接的文献网络图示:

本文的引文网络