kClust: fast and sensitive clustering of large protein sequence databases

Maria Hauser1, Christian E Mayer, Johannes Söding

  • 1Gene Center and Center for Integrated Protein Science (CIPSM), Ludwig-Maximilians-Universität München, Feodor-Lynen-Str, 25, Munich 81377, Germany. soeding@genzentrum.lmu.de.

BMC Bioinformatics
|August 16, 2013
PubMed
Summary

kClust efficiently clusters large protein sequence databases using an alignment-free prefilter and dynamic programming. This method significantly speeds up homology searches and improves accuracy for large datasets.

Related Concept Videos