BigHugger
sk Skill · waybarrios

trl-training

Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning). Supports SFT, DPO, GRPO, KTO, RLOO and Reward Model training via CLI commands.

installs 8w
0
30-day movement
starts with the next reading
Related entries
1
Connections
0
yamlbashPython
Host repository
waybarrios/opencode-power-pack
Licence
Apache-2.0 (modified; see UPSTREAMS.json)
Host stars
508
Host language
Python