home/categories/machine-learning/hxk622-tokendance-backend-app-skills-builtin-scientific-data-science-stable-baselines3-skill-md

machine-learningdata-ai

stable-baselines3

Production-ready reinforcement learning algorithms (PPO, SAC, DQN, TD3, DDPG, A2C) with scikit-learn-like API. Use for standard RL experiments, quick prototyping, and well-documented algorithm implementations. Best for single-agent RL with Gymnasium environments. For high-performance parallel training, multi-agent systems, or custom vectorized environments, use pufferlib instead.

সোর্স দেখুন machine-learning

maintainer

hxk622

আপডেট হয়েছে 1/19/2026

স্টার

ফর্ক

quick start

Installation and usage

ইনস্টলেশন

$ install --globalskills.sh

ব্যবহার

ইনস্টল করার পর, টার্মিনালে নিচের কমান্ড চালিয়ে আপনি এই স্কিল ব্যবহার করতে পারবেন:

skills use stable-baselines3