Retour au feed
Reddit r/LocalLLaMA·

Gemma 4 QAT Q4_0 Bench on Strix Halo

Signal
72
Hype
15
En 3 lignesBenchmark de Gemma 4 QAT Q4_0 (quantization-aware training) sur APU Strix Halo via llama.cpp Vulkan/RADV. Modèles testés : 12B (6.50 GiB), 26B-A4B (13.45 GiB), 31B (16.44 GiB). QAT préserve mieux le comportement du modèle original qu'une quantification post-entraînement. Têtes assistant QAT converties en GGUF pour meilleure acceptation.
Lire la source
Ton avis ?
GeminiOpen sourceBenchmarksInfrastructure

Résumé généré par Claude — vérifié par l'humain