machine-learningdata-ai
grpo-rl-training
Expert guidance for GRPO/RL fine-tuning with TRL for reasoning and task-specific model training
maintainer
math-inc
আপডেট হয়েছে 3/19/2026
স্টার
1165
ফর্ক
96
quick start
Installation and usage
Expert guidance for GRPO/RL fine-tuning with TRL for reasoning and task-specific model training
ইনস্টলেশন
$ install --globalskills.sh
ব্যবহার
ইনস্টল করার পর, টার্মিনালে নিচের কমান্ড চালিয়ে আপনি এই স্কিল ব্যবহার করতে পারবেন:
skills use grpo-rl-training