trl-training

Name: trl-training
Author: huggingface

Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning). Supports SFT, DPO, GRPO, KTO, RLOO and Reward Model training via CLI commands.

Посмотреть исходный код machine-learning

maintainer

huggingface

Обновлено 2/16/2026

Звёзды

17998

Форки

2632

quick start

Installation and usage

Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning). Supports SFT, DPO, GRPO, KTO, RLOO and Reward Model training via CLI commands.

Установка

$ install --globalskills.sh

Использование

После установки вы можете использовать этот skill, выполнив следующую команду в терминале:

skills use trl-training