软件工程 / 诊断修复

openrlhf-training

安装量 303GitHub Stars 27,328更新时间 2026年5月16日

描述

High-performance RLHF framework with Ray+vLLM acceleration. Use for PPO, GRPO, RLOO, DPO training of large models (7B-70B+). Built on Ray, vLLM, ZeRO-3. 2×…

安全审计

使用前的风险提示

未审计

规则审计

未审计

更新 1年1月1日

智能审计

未审计

更新 1年1月1日

uiperformancedockerllmopenrlhftrainingrlhfframeworkrayvllmaccelerationfor

GitHub 仓库