火山引擎开源Verl框架,加速大模型强化学习训练
火山引擎Verl是一个由字节跳动种子团队发起并维护的开源强化学习训练库,专为大型语言模型(LLM)设计。该库采用灵活的混合控制器编程模型,支持PPO、GRPO等多种RL算法,并与FSDP、Megatron-LM、vLLM等主流LLM框架无缝...
火山引擎Verl是一个由字节跳动种子团队发起并维护的开源强化学习训练库,专为大型语言模型(LLM)设计。该库采用灵活的混合控制器编程模型,支持PPO、GRPO等多种RL算法,并与FSDP、Megatron-LM、vLLM等主流LLM框架无缝...