Trl Training

作者 huggingfaceabc20ae526d8Apache-2.011K 个星标收录于 2026年10月8日更新于 2026年10月8日仓库今天更新

Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning). Supports SFT, DPO, GRPO, KTO, RLOO and Reward Model training via CLI commands.

仅含说明AI & Agents
  1. abc20ae526d8当前提交 abc20ae发布于 2026年10月8日

来源与署名

来源:huggingface/skills位于skills/trl-training提交abc20ae

许可证: Apache-2.0

内容归原作者所有。SourceWeft 从公开仓库中收录这些内容。

举报或申请下架