AI и агенты
Официальный
trl-training
Официальный skill Hugging Face помогает выбрать и настроить SFT, DPO, GRPO, KTO, RLOO и Reward Model training через библиотеку TRL.
Для чего подходит
- Подготовка SFT и preference training
- Настройка GRPO, KTO и RLOO
- Обучение Reward Model через TRL
Установка
Сначала прочитайте SKILL.md и scripts в исходном репозитории. Затем выполните команду в каталоге проекта:
npx skills add https://github.com/huggingface/skills/tree/main/skills/trl-trainingПеред установкой
Neira проверила доступность публичного источника, имя SKILL.md и происхождение записи. Это не security-аудит. Скилл может запускать команды и обращаться к вашим файлам или внешним сервисам.