序列处理工具
这一类处理的是序列本身:一段 DNA、RNA 或蛋白序列进来, 换个表示、算个性质、找个位点。
从哪个开始:手上是一段 DNA 就先用反向互补和序列统计 把方向和组成弄清楚;要表达就用六框翻译确认读框; 要克隆就用限制酶分析看切点; 要做 PCR 就用引物 Tm和引物二聚体。
这一类共同的坑是方向和坐标。反向互补之后链的方向变了, 基于原链算出来的位点全部作废;而基因组坐标有 0 基和 1 基两套约定, UCSC 的 BED 与 Ensembl/GFF 差一位,跨库拼接时这一位会一路错到底—— 坐标换算专门管这件事。
另一个容易混的是密码子:密码子表查的是「这个三联体编码什么」, 密码子使用频率回答的是「在这个宿主里这个三联体常不常用」。 前者是遗传密码,后者是物种偏好,做异源表达时要的是后者。
序列全部在你自己的浏览器里处理,不上传、不留存——未发表的序列可以放心粘进来。
序列处理
DNA / RNA 反向互补序列在线转换
粘贴序列即得反向互补、互补、反向三种结果,支持 FASTA 与 IUPAC 简并碱基。
DNA 序列 GC 含量与 Tm 值在线计算
计算 GC%、碱基组成、分子量与两种经验 Tm,适合快速检查引物。
DNA 序列翻译成蛋白质(六框翻译)在线工具
标准遗传密码表,支持单框与六框翻译、ORF 查找。
FASTA 文件统计:序列数、长度分布与 N50
粘贴 multi-FASTA,立刻得到条数、总长、N50/L50、GC% 和长度分布。
蛋白质分子量、等电点与 280nm 消光系数在线计算
输入氨基酸序列,算出分子量、理论 pI、摩尔消光系数和 1 mg/mL 的 A280。
双序列比对在线工具(Needleman-Wunsch 全局比对)
两条序列全局比对,给出比对结果、得分、一致度与错配/空位统计。
密码子表速查(标准遗传密码):密码子与氨基酸双向查询
标准遗传密码全部 64 个密码子,支持密码子查氨基酸、氨基酸反查密码子,DNA 与 RNA 写法都认。
氨基酸性质速查表:分子量、侧链 pKa、疏水性与密码子数
20 种标准氨基酸的残基质量、游离分子量、侧链 pKa、Kyte-Doolittle 疏水性与密码子数,支持单字母/三字母/中英文名查询。
常用限制酶识别序列速查表与酶切位点查找
30 种常用限制酶的识别序列、切点、末端类型与平均间隔,并可粘贴序列查找酶切位点(支持线性与环状)。
非标准遗传密码表对照:线粒体、细菌与纤毛虫密码子差异速查
NCBI 全部 27 张遗传密码表,逐个密码子列出与标准表的差异,支持按表号与密码子查询。
密码子偏好性表与稀有密码子扫描(含 CAI 计算)
九个常用物种的密码子使用频率,粘贴 CDS 即可扫描稀有密码子、算 CAI,并给出每个氨基酸在该宿主里的最优密码子。
引物二聚体与发夹结构在线检测(含 3′ 端互补分析)
检测引物的自身二聚体、发夹结构与引物对交叉二聚体,单列 3′ 端连续互补数并画出配对示意。
最近邻法 Tm 计算器
用最近邻热力学模型算引物 Tm,给出 ΔH、ΔS、ΔG37,并把 PCR 缓冲液里的 Mg2+ 与 dNTP 折成钠当量。
FASTQ 质量值换算器
Q 值与错误率互换,并解析 FASTQ 质量串:平均质量按正确算法计算,同时给出 ≥Q20/Q30 占比与期望错误数。
基因组坐标系转换器
BED 与 GFF/VCF/SAM 的坐标差 1,这里一次换清楚,并给出可直接粘贴的 BED 与 GFF 行。