CSV-Filter:一种基于深度学习的综合结构变体选方法,用于短读和长读
Zeyu Xia1, Weiming Xiang2, Qingzhe Wang1
1College of Computer Science and Technology, National University of Defense Technology, Hunan 410073, P. R. China.
Bioinformatics (Oxford, England)
|September 6, 2024
概括
新的深度学习工具CSV-Filter有效地减少了虚假正的结构变异 (SV) 调用在短和长读的遗传数据中. 这种方法通过改进SV检测过来提高基因研究和精密医学的准确性.
科学领域:
- 基因组学就是基因组学.
- 生物信息学是一种生物信息学.
- 计算生物学 计算生物学
背景情况:
- 结构变异 (SV) 在遗传研究和精密医学中至关重要.
- 当前的SV检测方法通常会产生许多错误的阳性呼叫,需要有效的过策略.
研究的目的:
- 开发和评估CSV-Filter,这是一种基于深度学习的新型工具,用于过结构变量调用.
- 为了提高SV检测的准确性,无论是短时间还是长时间的测序读取.
主要方法:
- 开发了CSV-Filter,这是一个深度学习工具,使用CIGAR字符串的多级灰度图像编码.
- 使用图像增强和自我监督的学习网络来增强 SV 功能提取和分类.
- 实施混合精度操作以加快模型训练.
主要成果:
- 当与现有的短读和长读两种SV检测工具集成时,CSV-Filter显著减少了假阳性SV.
- 真正阳性SV电话在很大程度上被保留,保持高灵敏度.
- 在识别假阳性数据方面,CSV-Filter的表现优于DeepSVFilter,并且还支持长读数据.
结论:
- CSV-Filter提供了一个强大而准确的解决方案,用于过结构变体,适用于各种序列数据类型.
- 该工具提高了SV检测的可靠性,支持基因研究和精准医学的进步.


