Fetching the paper…

Inverse-RLignment: Large Language Model Alignment from Demonstrations through Inverse Reinforcement Learning · Around