Retour au feed
arXiv cs.CL·

LakeQA: An Exploratory QA Benchmark over a Million-Scale Data Lake

Signal
78
Hype
25
En 3 lignesLakeQA est un benchmark QA sur 9,5 TB de données hétérogènes (Wikipedia + données gouvernementales) nécessitant recherche et raisonnement multi-hop. GPT-4.5 atteint 18,37% en exact-match. Évalue la capacité des agents LLM à découvrir et analyser des documents dans des data lakes massives.
Lire la source
Ton avis ?
BenchmarksRaisonnementRAGAgents IA

Résumé généré par Claude — vérifié par l'humain