使用统计方法和机器学习开发,研究和比较对流感病毒的交叉免疫模型
M N Asatryan1, I S Shmyr1, B I Timofeev1
1National Research Center for Epidemiology and Microbiology named after Honorary Academician N.F. Gamaleya.
Voprosy virusologii
|October 3, 2024
概括
交叉免疫的数学建模有助于识别新的抗原变体,用于公共卫生. 复杂的机器学习模型,如梯度增强,在各种数据集上进行测试时表现最好,以便进行可靠的预测.
科学领域:
- 免疫学 免疫学 免疫学
- 计算生物学 计算生物学
- 流行病学 流行病学
背景情况:
- 来自血液凝结抑制试验的抗体标位是世界卫生组织评估疫苗接种成功的关键.
- 交叉免疫的数学建模对于实时识别新出现的抗原变体至关重要,这对公共卫生至关重要.
- 准确预测抗原变体对于及时更新疫苗和有效控制疾病至关重要.
研究的目的:
- 评估不同统计和机器学习模型在预测抗原变异方面的性能.
- 评估各种抗原逃逸值和数据集组成对模型准确性的影响.
- 确定跨不同数据集的交叉免疫模型的稳定性.
主要方法:
- 采用后勤回归,随机森林和梯度增强模型.
- 使用AAindex矩阵与哈明距离计算结合使用.
- 在四个不同的数据集上测试模型,具有不同的抗原逃脱值.
主要成果:
- 更复杂的模型,特别是梯度增强,通常产生了优异的预测性能.
- 模型在训练之前的季节时表现出最高的准确性 (例如,2022年2月为2022年秋季的预测).
- 在不同的数据集中,模型性能差异很大,这凸显了多样化测试的重要性.
结论:
- 复杂的机器学习模型在交叉免疫预测方面表现优于简单的模型.
- 对各种数据集进行彻底的测试对于确定交叉免疫模型的预后稳定性至关重要.
- 选择抗原逃逸值和纳入AAindex矩阵对模型性能的影响有限.


