Hacker NewsmikeaylesMon, Aug 10, 2026, 4:52 AM PDT
score 24.5
75HN30HN cmts
Tiny language model runs at 60k tokens per second on a $250 FPGA
Original: Show HN: A tiny LLM running at 21,000 tok/s on a $250 FPGA (Live Demo)
Source: mikeayles.com ↗
Writing ELI5 summary…