Fetching the paper…

FlexSP: Accelerating Large Language Model Training via Flexible Sequence Parallelism · Around