Retour au feed
Reddit r/MachineLearning·

Open weights are not enough: we need open training frameworks for research and better algorithms [P]

Signal
72
Hype
28
En 3 lignesFeynRL, un framework open-source pour le post-training RL des LLMs et agents, vise à rendre la formation transparente et modifiable. L'auteur argue que les poids ouverts ne suffisent pas : il faut des codebases d'entraînement explicites séparant algorithmes et systèmes. Le framework supporte SFT, DPO, multi-GPU et clusters.
Lire la source
Ton avis ?
Open sourceReinforcement learningGénération de codeAgents IAOutils

Résumé généré par Claude — vérifié par l'humain