Cutting LLM Batch Inference Time by Half with Dynamic Prefix Bucketingdaft.ai2 points·DISCURSIVE··0 commentsOpen articleSaveView on HN