Cutting LLM Batch Inference Time in Half: Dynamic Prefix Bucketing at Scaledaft.ai5 points·ykev··1 commentOpen articleSaveView on HN