Retour au feed
arXiv cs.CL·

Small LLMs for Biomedical Claim Verification: Cost-Effective Fine-Tuning, Structural Dataset Shortcuts, and Cross-Domain Generalization

Signal
78
Hype
15
En 3 lignesTrois petits LLM (Phi-3-mini 3.8B, Qwen2.5-3B, Mistral-7B) sont fine-tunés via QLoRA pour la vérification de claims biomédicaux. Mistral-7B surpasse GPT-4o et GPT-5 (+12% F1) avec 1,008 exemples d'entraînement. Étude révèle un artefact structurel dans SciFact et démontre une généralisation cross-domain robuste.
Lire la source
Ton avis ?
MistralQwenFine-tuningBenchmarksPapers

Résumé généré par Claude — vérifié par l'humain