Back to feed
Reddit r/LocalLLaMA·

DifussionGemma 4 on 4x7900xtx

Signal
65
Hype
15
In three linesDiffusionGemma 26B deployment on 4x AMD 7900 XTX via vLLM. Performance: 100 tokens/s generation, 45-60 t/s prompt processing. KV cache: 152k tokens. GPU memory usage: ~23.6-23.7 GB per card, temps 78-88°C.
Read source
Your take?
Code generationInfrastructureOpen source

Summary generated by Claude — human-verified