#24260 merged Llama.cpp Arch Cohere-Moe Support Added
Signal
65
Hype
25
En 3 lignesLe PR #24260 de llama.cpp ajoute le support de l'architecture Cohere-MoE. Les utilisateurs testent les modèles North Mini Code, plus compacts (3GB de moins en Q8) que Qwen 3.6 27B pour l'inférence locale sur homelab.Lire la source
Ton avis ?
Résumé généré par Claude — vérifié par l'humain