DNA 序列翻译成蛋白质(六框翻译)在线工具
把核酸序列翻译成氨基酸,用的是标准遗传密码表(NCBI translation table 1)。 每三个碱基一个密码子,64 个密码子对应 20 种氨基酸加 3 个终止信号。
为什么要六框? 一段序列你事先不知道读码框在哪,也不知道编码在正链还是负链。 正链三个偏移(0/1/2)加上反向互补链三个偏移,一共六种可能,全试一遍才不会漏。
工具会同时列出每个框里的开放阅读框(ORF):从 ATG 开始、到终止密码子结束、且长度达到阈值的片段。 这是最朴素的 ORF 定义,真核基因有内含子,不能直接这么找——这个工具适用于原核基因、cDNA 和质粒序列。
常见问题
* 和 X 分别代表什么?
* 是终止密码子(TAA/TAG/TGA);X 表示该密码子含有 N 或非法字符,无法确定氨基酸。
为什么真核基因翻译出来是乱的?
真核基因组序列含内含子,必须先剪接。请用 mRNA/cDNA 序列,或先做基因结构注释。