发明名称 基于多步双向De Bruijn图的变长kmer查询的双向边扩展方法
摘要 本发明涉及基因测序技术领域,提供了一种基于多步双向De Bruijn图的变长kmer查询的顶点扩展方法,包括:步骤A:读取测序数据源文件,构造多步双向De Bruijn图;步骤B:在所述多步双向De Bruijn图中对交叉双向边进行统计;步骤C:在所述多步双向De Bruijn图中基于变长kmer查询的双向边扩展。本发明只针对De Bruijn图上已经存在的分叉边构造变长的kmer组合,并在输入序列中查询其出现次数,然后根据其次数选择双向边的合并;选择最优的分叉边的合并,将双向边的错误合并的可能降到最低;可以显著提高contigs的长度,也能够将contig的质量损失降到最小。
申请公布号 CN103699818A 申请公布日期 2014.04.02
申请号 CN201310670740.1 申请日期 2013.12.10
申请人 深圳先进技术研究院 发明人 孟金涛;张慧琳;彭丰斌;魏彦杰;冯圣中
分类号 G06F19/22(2011.01)I 主分类号 G06F19/22(2011.01)I
代理机构 深圳市科进知识产权代理事务所(普通合伙) 44316 代理人 沈祖锋;郝明琴
主权项 一种基于多步双向De Bruijn图的变长kmer查询的双向边扩展方法,其特征在于,包括:步骤A:读取测序数据源文件,构造多步双向De Bruijn图;步骤B:在所述多步双向De Bruijn图中对交叉双向边进行统计;步骤C:在所述多步双向De Bruijn图中基于变长kmer查询的双向边扩展。
地址 518055 广东省深圳市南山区西丽大学城学苑大道1068号