HuggingFace Transformer Reinforcement Learning. The gold-standard open library for SFT, PPO, DPO, KTO, and reward modeling. Powers most aligned open-weight models.