节点文献
基于Pearson系数的芯片数据预处理方法
【摘要】 数据预处理可以大大降低数据挖掘算法的成本和提高数据挖掘的效率,尤其对于海量和高维的基因表达数据更为重要。针对K-means算法对数据预处理手段敏感的问题,文章提出了一种以管家基因法初始化数据、Pearson系数度量芯片数据相似性的预处理方法。具体的实验数据证明了该方法能很好地解决上述问题并有效地提高k-means算法的收敛速度。
【关键词】 管家基因法;
Pearson相关系数;
K-均值聚类;
芯片数据;
【基金】 国家863计划资助项目(2003AA116060)
- 【文献出处】 计算机时代 ,Computer Era , 编辑部邮箱 ,2006年11期
- 【分类号】TP311.13
- 【被引频次】4
- 【下载频次】159