Retour au feed
arXiv cs.AI·

How Small Can You Go? LoRA Fine-Tuning 270M-8B Models for Merchant Information Extraction in Financial Transactions

Signal
78
Hype
15
En 3 lignesÉtude comparative de 24 variantes de modèles (270M-8B) fine-tunés en LoRA pour l'extraction d'informations marchands dans les transactions financières. Qwen 3.5 4B atteint 96.60% F1 (vs 96.95% pour LLaMA 3.1-8B) avec moitié moins de paramètres. Le modèle 0.8B Qwen 3.5 obtient 94.75% F1, rivalisant avec des modèles 2.5-4x plus grands.
Lire la source
Ton avis ?
Fine-tuningLlamaQwenBenchmarksGénération de code

Résumé généré par Claude — vérifié par l'humain