Open weights are not enough: we need open training frameworks for research and better algorithms [P]
Signal
72
Hype
28
En 3 lignesFeynRL, un framework open-source pour le post-training RL des LLMs et agents, vise à rendre la formation transparente et modifiable. L'auteur argue que les poids ouverts ne suffisent pas : il faut des codebases d'entraînement explicites séparant algorithmes et systèmes. Le framework supporte SFT, DPO, multi-GPU et clusters.Lire la source
Ton avis ?
Résumé généré par Claude — vérifié par l'humain