Theoretical Bottlenecks for Scaling LLM Inference to Get Higher Token per Secondtwitter.com2 points·arjmandi··1 commentOpen articleSaveView on HN