Fetching the paper…

SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator · Around