TRL Training
Trenuje i dostraja modele językowe za pomocą TRL: SFT, DPO, GRPO, KTO, RLOO i trening modeli nagrody przez polecenia CLI. Używaj do fine-tuningu i RLHF transformerów.
npx bazanarzedzi install trl-training | Autor | huggingface |
| Źródło | https://github.com/huggingface/skills → skills/trl-training |
| Licencja | Apache-2.0 |
| GitHub | ★ 11k (repozytorium, stan: lipiec 2026) |
| Działa z | Claude Code |
| Kategorie | AI i agenci |
Opis oryginalny: Train and fine-tune transformer LMs with TRL: SFT, DPO, GRPO, KTO, RLOO, and reward model training via CLI.