Trl Training

作者 huggingfaceabc20ae526d8Apache-2.011K 個星標收錄於 2026年10月8日更新於 2026年10月8日儲存庫今天更新

Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning). Supports SFT, DPO, GRPO, KTO, RLOO and Reward Model training via CLI commands.

僅含說明AI & Agents

僅公開檔案列表。將技能安裝到工作區後即可檢視檔案內容。

路徑大小類型
SKILL.md8.6 KBtext/markdown

來源與署名

來源:huggingface/skills位於skills/trl-training提交abc20ae

授權條款: Apache-2.0

內容歸原作者所有。SourceWeft 從公開儲存庫中收錄這些內容。

檢舉或申請下架