Retour au feed
Reddit r/LocalLLaMA·

Gemma 12b less than 10 watts 6.5pp 1.3tg

Signal
65
Hype
15
En 3 lignesGemma 12B exécuté sur Google Pixel 10 Pro via Termux et llama.cpp (v9639) consomme moins de 10W. Performance : 6.5 tokens/s en prompt, 1.3 tokens/s en génération avec contexte 32k et quantification Q3_K_XL.
Lire la source
Ton avis ?
GeminiOpen sourceInfrastructure

Résumé généré par Claude — vérifié par l'humain