Model 4 bit inference 4.2x faster than 16 bit with full HF supporttwitter.com2 points·convexstrictly··1 commentOpen articleSaveView on HN