Fetching the paper…

AdaSpec: Adaptive Speculative Decoding for Fast, SLO-Aware Large Language Model Serving · Around