Long Live Fine-Tuning: Task-Specific Transformers Outperform Zero-Shot LLMs for Misinformation Response Classification on Reddit
Signal
78
Hype
15
En 3 lignesFine-tuned RoBERTa surpasse les LLMs zero-shot (Claude Haiku, Gemini Flash) sur la classification de réponses à la désinformation Reddit : 0.62 macro-F1 vs 0.50. L'augmentation de taille (Llama-3-70B vs 8B) n'aide pas. Les alignements de sécurité des modèles commerciaux dégradent la détection de croyances (0.17 pour Claude Sonnet).Lire la source
Ton avis ?
Résumé généré par Claude — vérifié par l'humain