Trl Training

作者 huggingfaceabc20ae526d8Apache-2.011K 个星标收录于 2026年10月8日更新于 2026年10月8日仓库今天更新

Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning). Supports SFT, DPO, GRPO, KTO, RLOO and Reward Model training via CLI commands.

仅含说明AI & Agents

仅公开文件列表。将技能安装到工作区后即可查看文件内容。

路径大小类型
SKILL.md8.6 KBtext/markdown

来源与署名

来源:huggingface/skills位于skills/trl-training提交abc20ae

许可证: Apache-2.0

内容归原作者所有。SourceWeft 从公开仓库中收录这些内容。

举报或申请下架