研究学习 / 检索整理

openrlhf-training

安装量 201GitHub Stars 8,482更新时间 2026年5月16日

描述

High-performance RLHF framework with Ray+vLLM acceleration. Use for PPO, GRPO, RLOO, DPO training of large models (7B-70B+). Built on Ray, vLLM, ZeRO-3. 2×…

安全审计

使用前的风险提示

未审计

规则审计

未审计

更新 1年1月1日

智能审计

未审计

更新 1年1月1日

uiperformancedockerllmopenrlhftrainingrlhfframeworkrayvllmaccelerationfor

GitHub 仓库