Extraction of high quality k-words for alignment-free sequence comparison

Upuli Gunasinghe1, Damminda Alahakoon2, Susan Bedingfield1

  • 1Clayton School of Information Technology, Faculty of Information Technology, Monash University, VIC 3800, Australia.

Summary

Selecting a subset of k-words significantly speeds up biological sequence comparison using the weighted Euclidean distance (D(2)) without sacrificing accuracy. This method enhances computational efficiency in analyzing genetic data.