Agent skill · davila7
slime-rl-training
Provides guidance for LLM post-training with RL using slime, a Megatron+SGLang framework. Use when training GLM models, implementing custom data generation
Reference it in any coding agent with:
@skills davila7/slime-rl-training