Retour au feed
Reddit r/LocalLLaMA·

SIQ-1 Qwen3.6 for autoresearch and autonomous agency

Signal
65
Hype
45
En 3 lignesSIQ-1 Qwen3.6 : fine-tuning PPO du Qwen-35B-A3 surpassant GLM-5.2 et Qwen-350B sur autoresearch (karpathy benchmark) et bullshit-bench. Modèle + GGUF disponibles sur HuggingFace avec agent démo.
Lire la source
Ton avis ?
QwenReinforcement learningAgents IABenchmarksOpen source

Résumé généré par Claude — vérifié par l'humain