DOI：10.3969/j.issn.2095-2163.2011.04.007

基于平均交互信息量的DNA序列相似性分析

引用

摘要：

序列相似性分析是生物信息学中一个重要问题,对于研究物种的进化起源有着重要的意义.序列相似性算法包括基于序列比对的方法及非比对方法两种.基于比对的方法对于序列整体的衡量略有欠缺；非比对算法中有DNA曲线化方法以及比较序列各自整体碱基分布间的信息量差异的方法,只是考虑了序列整体信息间的差异,但未考虑序列各个位点间的差异.因此,提出了一种基于信息熵的相似性度量模型,把序列比对与信息量差异结合起来,将两条比对后的序列间的平均交互信息量与其联合熵之比作为两条序列的相似性度量.使用该度量构建了11个物种的相似性矩阵,对各物种间的相似性进行了分析,结果在一定程度上与生物分类学相契合.通过距离矩阵所构建的进化树,也反映了各物种间的进化关系,表明该模型的设计具有合理性.

关键词：生物信息学、DNA序列相似性、信息熵、平均交互信息量、进化树

所属期刊栏目：1

分类号：TP39(计算技术、计算机技术)

在线出版日期：2012-03-05（万方平台首次上网日期，不代表论文的发表时间）

页数：共5页

页码：31-34,52

英文信息展示

期刊专题