
A developer has a 28.9-million-parameter model generating TinyStories-style text at 9.88 tokens per second, fully offline, on a $10 microcontroller It was achieved by fitting a language model on a chip with 512KB of RAM by leaving most of…
View original source — TechRadar ↗

