Back to feed
Reddit r/LocalLLaMA·

#24260 merged Llama.cpp Arch Cohere-Moe Support Added

Signal
65
Hype
25
In three linesPR #24260 merged into llama.cpp adds Cohere-MoE architecture support. Users testing North Mini Code models, which are ~3GB smaller in Q8 quantization compared to Qwen 3.6 27B for local inference on homelabs.
Read source
Your take?
LlamaOpen sourceCode generationInfrastructure

Summary generated by Claude — human-verified