Commit a933a52
committed
feat(ai): add reinforcement learning explainers
Add standalone visual explainers for GRPO, RLHF, and RLVR training methods. These pages make the core reinforcement-learning alignment approaches easier to compare and understand alongside the existing model training explainers.1 parent 7a9c390 commit a933a52
3 files changed
Lines changed: 1326 additions & 0 deletions
0 commit comments