Agent skill · davila7

verl-rl-training

Provides guidance for training LLMs with reinforcement learning using verl (Volcano Engine RL). Use when implementing RLHF, GRPO, PPO, or other RL algorith

Reference it in any coding agent with:

@skills davila7/verl-rl-training

Browse the @skills marketplace