Back to feed
Hacker News (AI)·

GateGPT: 56k tokens per second Transformer (KV cache) on FPGA at 80 MHz

Signal
65
Hype
25
In three linesGateGPT achieves 56k tokens/sec on FPGA at 80 MHz by optimizing Transformer KV cache. Hardware acceleration demonstration for inference.
Read source
Your take?
InfrastructureBenchmarks

Summary generated by Claude — human-verified