Gemma 4 QAT Q4_0 Bench on Strix Halo
Signal
72
Hype
15
En 3 lignesBenchmark de Gemma 4 QAT Q4_0 (quantization-aware training) sur APU Strix Halo via llama.cpp Vulkan/RADV. Modèles testés : 12B (6.50 GiB), 26B-A4B (13.45 GiB), 31B (16.44 GiB). QAT préserve mieux le comportement du modèle original qu'une quantification post-entraînement. Têtes assistant QAT converties en GGUF pour meilleure acceptation.Lire la source
Ton avis ?
Résumé généré par Claude — vérifié par l'humain