跳到正文
AI HOT 精选

Hugging Face 用 LoRA 和云存储桶在 HF Jobs 上跑异步 GRPO,省掉 NCCL,速度提升 3.9 倍

Hugging Face 用 LoRA 与 Storage Bucket 在 HF Jobs 上跑异步 GRPO,免 NCCL 并提速 3.9 倍

TRL v1.14 的 AsyncGRPOTrainer 现在可以只训练 LoRA 适配器,并通过一个云存储桶来同步权重,让训练任务和 vLLM 推理任务跑在不同的机器上,不再需要 NCCL 通信。Hugging Face 说这比同步方案快了 3.9 倍。不过正文没给出测试的具体配置和延迟数据,这个提速数字我先打个折,等看到细节再说。

读原文 ↗导出 Markdown