Retour au feed
Reddit r/LocalLLaMA·

Here is my llama.cpp NVFP4/MXFP6 GGUF quantizer tool

Signal
72
Hype
25
En 3 lignesOutil de quantification GGUF open-source (MIT) pour créer des modèles NVFP4 et MXFP6. Utilise imatrix et logits KLD pour évaluer et combiner plusieurs méthodes de quantification par couche. Démontre de meilleures performances que ModelOpt sur Qwen 27B. Inclut rapports détaillés et validation reproductible.
Lire la source
Ton avis ?
LlamaOpen sourceOutilsBenchmarks

Résumé généré par Claude — vérifié par l'humain