跳到正文
原文
Hugging Face Blog·· 2025-06-03AI 评分56

Hugging Face TRL 支持与 GRPO 训练共置 vLLM,训练和推理共享同一批 GPU

No GPU left behind: Unlocking Efficiency with Co-located vLLM in TRL

AI 导读

Hugging Face 在 TRL v0.18.0 通过 PR #3394 引入 vllm_mode="colocate",让 vLLM 不再以独立 HTTP 服务器运行,而是嵌入同一分布式进程组,与 GRPO 训练共享同一批 GPU,消除训练与生成之间的互相等待。

来源:Hugging Face Blog · huggingface.co