Retour au feed
arXiv cs.CL·

GENEB: Why Genomic Models Are Hard to Compare

Signal
78
Hype
15
En 3 lignesGENEB est un benchmark diagnostic à grande échelle évaluant 40 modèles fondamentaux génomiques sur 100 tâches dans 13 catégories fonctionnelles sous un protocole unifié. L'analyse révèle que les classements agrégés sont instables : les rangs varient fortement entre catégories, l'échelle offre des gains modestes et inconsistants, et l'alignement architectural surpasse souvent le nombre de paramètres.
Lire la source
Ton avis ?
BenchmarksPapersÉvaluations

Résumé généré par Claude — vérifié par l'humain