科技 来源:Hugging Face Blog 整理:feaOS 2026-09-16 14:56:50

Hugging Face Jobs与LoRA技术结合实现高效模型训练

近日,TRL的AsyncGRPOTrainer引入了对LoRA的支持,并在版本1.14中发布。这项技术允许模型仅通过同步轻量级适配器(LoRA)而非整个模型来进行训练和推理。具体项目实践中,一个小型代理服务器被部署以处理认证头并路由请求至合适的副本节点,从而实现高效的数据传输与计算分离。在实际应用中,训练过程不再需要与推理共享同一台机器,通过使用轻量级适配器,可以显著减少数据同步的时间和带宽需求。实验结果显示,在500步的训练中,使用该方法可以将时间从3小时27分钟缩短到53分钟。此外,LoRA技术特别适用于强化学习(RL),因为它能够匹配全模型微调的效果,并且只需要发送适配器而不是整个模型,从而大大减少了网络传输的需求和延迟。

ENTRY_ID: NEWS-17080 READ_MODE: SHORT_SIGNAL