跳到正文
原文
Hugging Face Blog·· 2024-07-18精选AI 评分60

TGI 推出 Multi-LoRA serving,一次部署可服务多个微调模型

TGI Multi-LoRA: Deploy Once, Serve 30 Models

AI 导读

Hugging Face 在 TGI 中推出 Multi-LoRA serving,只部署一次基座模型 mistralai/Mistral-7B-v0.1,即可按请求动态选择 LoRA 适配器,一次部署相当于服务多个微调模型。

推荐理由

原文给出部署步骤、显存开销和成本对比数据,读者可以据此评估一次部署服务多个微调模型是否适合自己的场景。

来源:Hugging Face Blog · huggingface.co