首页 / 资料库 / 文献详情

蛋白质二级结构预测: 基于词条的最大熵马尔科夫方法

基于词条的最大熵 马尔科夫方法提出了一种新的蛋白质二级结构预测方法 该方法从氨基酸序列中提取出和自然语言 中的类似的与物种相关的蛋白质二级结构词条林磊关毅赵健

2005Science in China Series C-Life Sciences (in Chinese)Biochemistry, Genetics and Molecular Biology被引 1开放获取

下载 PDF 全文出版方页面 →

摘要

提出了一种新的蛋白质二级结构预测方法. 该方法从氨基酸序列中提取出和自然语言中的“词”类似的与物种相关的蛋白质二级结构词条, 这些词条形成了蛋白质二级结构词典, 该词典描述了氨基酸序列和蛋白质二级结构之间的关系. 预测蛋白质二级结构的过程和自然语言中的分词和词性标注一体化的过程类似. 该方法把词条序列看成是马尔科夫链, 通过Viterbi算法搜索每个词条被标注为某种二级结构类型的最大概率, 其中使用词网格描述分词的结果, 使用最大熵马尔科夫模型计算词条的二级结构概率. 蛋白质二级结构预测的结果是最优的分词所对应的二级结构类型. 在4个物种的蛋白质序列上对这种方法进行测试, 并和PHD方法进行比较. 试验结果显示, 这种方法的Q3准确率比PHD方法高3.9%, SOV准确率比PHD方法高4.6%. 结合BLAST搜索的局部相似的序列可以进一步提高预测的准确率. 在50个CASP5目标蛋白质序列上进行测试的结果是: Q3准确率为78.9%, SOV准确率为77.1%. 基于这种方法建立了一个蛋白质二级结构预测的服务器, 可以通过http://www.insun.hit.edu.cn:81/demos/biology/index.html来访问.

引用本文(GB/T 7714)

基于词条的最大熵 马尔科夫方法, 提出了一种新的蛋白质二级结构预测方法 该方法从氨基酸序列中提取出和自然语言 中的类似的与物种相关的蛋白质二级结构词条, 林磊, 等. 蛋白质二级结构预测: 基于词条的最大熵马尔科夫方法[J]. Science in China Series C-Life Sciences (in Chinese), 2005.

引文网络

参考文献与被引分析加载中…

DOI:https://doi.org/10.1360/zc2005-35-1-87

本站仅收录题录与摘要供学习参考,全文版权归属出版方;如有侵权请联系我们删除。