Hugging Face Blog·· 2025-06-03AI 评分56
Hugging Face TRL 支持与 GRPO 训练共置 vLLM,训练和推理共享同一批 GPU
No GPU left behind: Unlocking Efficiency with Co-located vLLM in TRL
AI 导读
Hugging Face 在 TRL v0.18.0 通过 PR #3394 引入 vllm_mode="colocate",让 vLLM 不再以独立 HTTP 服务器运行,而是嵌入同一分布式进程组,与 GRPO 训练共享同一批 GPU,消除训练与生成之间的互相等待。
来源:Hugging Face Blog · huggingface.co