GateGPT: 56k tokens per second Transformer (KV cache) on FPGA at 80 MHz
Signal
65
Hype
25
In three linesGateGPT achieves 56k tokens/sec on FPGA at 80 MHz by optimizing Transformer KV cache. Hardware acceleration demonstration for inference.Read source
Your take?
Summary generated by Claude — human-verified