HN
Hacker News
Top
New
Best
Ask
Show
Jobs
Comment by mwitiderrick | Hacker News Reader
1 point
·
mwitiderrick
·
·
1 comment
View on HN
mwitiderrick
(original poster)
·
"What’s impressive is that the sparse fine-tuned LLM can achieve 7.7 tokens per second on a single core and 26.7 tokens per second on 4 cores of a cheap consumer AMD Ryzen CPU."
Reply on news.ycombinator.com