Agent skill · sickn33
trl-training
Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning). Supports SFT, DPO, GRPO, KTO, RLOO and Reward Model traini
Reference it in any coding agent with:
@skills sickn33/trl-training--4dfbc1