A Collection of Benchmark Data Sets for Knowledge Graph-based Similarity in the Biomedical Domain.

Carlota Cardoso1, Rita T Sousa1, Sebastian Köhler2

  • 1Departamento de informática, LASIGE Faculdade de Ciências da Universidade de Lisboa, 1749 - 016 Lisboa, Portugal.

Summary

This study introduces 21 benchmark datasets for evaluating biomedical knowledge graph semantic similarity measures. These datasets use similarity proxies to overcome challenges in creating gold standards for complex biological data.