Agent skill · sickn33

trl-training

Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning). Supports SFT, DPO, GRPO, KTO, RLOO and Reward Model traini

Reference it in any coding agent with:

@skills sickn33/trl-training--edb412

Browse the @skills marketplace