← Skille

Skill

TRL Training

Trenuje i dostraja modele językowe za pomocą TRL: SFT, DPO, GRPO, KTO, RLOO i trening modeli nagrody przez polecenia CLI. Używaj do fine-tuningu i RLHF transformerów.

Instalacja z terminala
npx bazanarzedzi install trl-training
Autorhuggingface
Źródło https://github.com/huggingface/skills → skills/trl-training
LicencjaApache-2.0
GitHub★ 11k (repozytorium, stan: lipiec 2026)
Działa z Claude Code
Kategorie AI i agenci

Opis oryginalny: Train and fine-tune transformer LMs with TRL: SFT, DPO, GRPO, KTO, RLOO, and reward model training via CLI.

Powiązane pozycje

Chcesz wdrożyć takie narzędzia w swojej firmie? Porozmawiajmy →