๐ŸŽฏ

grpo-rl-training

๐ŸŽฏSkill

from orchestra-research/ai-research-skills

VibeIndex|
What it does
|

A skill from the AI Research Engineering Skills library that teaches AI coding agents how to implement GRPO (Group Relative Policy Optimization) for reinforcement learning training of language models.

๐Ÿ“ฆ

Same repository

orchestra-research/ai-research-skills(158 items)

grpo-rl-training

Installation

Vibe Index InstallInstalls to .claude/skills/
npx vibeindex add orchestra-research/ai-research-skills --skill grpo-rl-training
skills.sh Installโš  Installs to .agents/skills/
npx skills add orchestra-research/ai-research-skills --skill grpo-rl-training
Manual InstallCopy SKILL.md content and save to the path below
~/.claude/skills/grpo-rl-training/SKILL.md

SKILL.md

279Installs
10,466
-
Last UpdatedJun 16, 2026