Fetching the paper…

Parallel Decoding via Hidden Transfer for Lossless Large Language Model Acceleration · Around