RepeatMasker中如何查找基因组上的重复序列
RepeatMasker中如何查找基因组上的重复序列
RepeatMasker中如何查找基因组上的重复序列,针对这个问题,这篇文章详细介绍了相对应的分析和解答,希望可以帮助更多想解决这个问题的小伙伴找到更简单易行的方法。
RepeatMasker软件用于查找基因组上的重复序列,默认情况下,会将重复序列原有的碱基用N代替,从而达到标记重复序列的目的。除此之外,也可以采用将重复序列转换为小写或者直接去除的方式,来标记重复序列。
该软件将输入的DNA序列与Dfam和Repbase数据库中已知的重复序列进行比对,从而识别输入序列中的重复序列。在比对时,支持以下多款软件
hmmer
cross_match
ABBlast/WUBlast
RMBlast
任选其中一个即可。官方提供了在线服务,网址如下
http://www.repeatmasker.org/cgi-bin/WEBRepeatMasker
在Sequence
中输入或者上传FASTA格式的DNA序列;Search Engine
选择比对软件,Speed/Sensitivity
选择运行模式,不同模式的主要区别在于运行速度与敏感度的差异,DNA source
选择参考物种。
当然也可以下载软件到本地运行,安装过程如下
wgethttp://www.repeatmasker.org/RepeatMasker-open-4-0-7.tar.gztarxzvfRepeatMasker-open-4-0-7.tar.gzcdRepeatMaskerperl./configure
需要注意的是,至少需要安装上述四种比对软件中的任意一种。此外,还需要安装TRF软件,链接如下
http://tandem.bu.edu/trf/trf.html
在安装过程中需要指定比对软件和TRF软件的安装位置。
软件基本用法如下
RepeatMasker-pa5-small-specieshumanchrM.fa
-pa
指定线程数,只有输入文件大于50Kb时才发挥作用;-small
表示将重复序列转换为小写,-species
指定参考的物种。
运行完成后,会生成多个文件,后缀为masked
的文件为标记重复序列后的文件,后缀为.out
的文件保存了重复序列区间信息。
关于RepeatMasker中如何查找基因组上的重复序列问题的解答就分享到这里了,希望以上内容可以对大家有一定的帮助,如果你还有很多疑惑没有解开,可以关注恰卡编程网行业资讯频道了解更多相关知识。
推荐阅读
-
polyfills怎么按需加载
polyfills怎么按需加载本篇内容主要讲解“polyfills...
-
C#数据类型怎么实现背包、队列和栈
C#数据类型怎么实现背包、队列和栈本文小编为大家详细介绍“C#数据...
-
C#怎么实现冒泡排序和插入排序算法
C#怎么实现冒泡排序和插入排序算法这篇文章主要讲解了“C#怎么实现...
-
C#如何实现希尔排序
C#如何实现希尔排序本篇内容主要讲解“C#如何实现希尔排序”,感兴...
-
C#如何实现归并排序
C#如何实现归并排序这篇文章主要介绍“C#如何实现归并排序”的相关...
-
C#怎么使用符号表实现查找算法
C#怎么使用符号表实现查找算法今天小编给大家分享一下C#怎么使用符...
-
C#类的静态成员怎么用
C#类的静态成员怎么用这篇“C#类的静态成员怎么用”文章的知识点大...
-
C#的静态函数怎么用
C#的静态函数怎么用这篇文章主要讲解了“C#的静态函数怎么用”,文...
-
C#中的析构函数怎么用
C#中的析构函数怎么用这篇文章主要讲解了“C#中的析构函数怎么用”...
-
怎么用CZGL.ProcessMetrics监控.NET应用
怎么用CZGL.ProcessMetrics监控.NET应用这篇文...