We're running Kimi 2.8 on a $107k server and getting around 50k tokens per second or better on most things.
We've already saved money compared to last years token cost on Claude/Gemini
We've already saved money compared to last years token cost on Claude/Gemini
Equipped with what? Is it CPU based inference, a mix...?