← 마켓
스킬

stable-baselines3

Production-ready reinforcement learning algorithms (PPO, SAC, DQN, TD3, DDPG, A2C) with scikit-learn-like API. Use for standard RL experiments, quick prototyping, and well-documented algorithm implementations. Best for single-agent RL with Gymnasium environments. For high-performance parallel training, multi-agent systems, or custom vectorized environments, use pufferlib instead.

원본 수집 · 실행 미검증

원작자와 원본 기록

출처
K-Dense-AI/claude-scientific-skills
원본 경로
skills/stable-baselines3/SKILL.md
고정 커밋 / 스냅샷
9cf7d9aea7d84754db4c167ab04b299d33c444bc
파일 SHA-256
f2b29acfdf6116e525eae9c89fcd1de925fb2be841727006b74e4a3bf5c37b4a
이용 조건
MIT · 고지문 보관

내 에이전트의 구성으로 저장하기

어떤 버전의 자료를 참고했는지 기록합니다. 적용할 수 있는 스킬은 지침을 확인한 뒤 텍스트 실습에 사용할 수 있습니다.

로그인하고 내 에이전트에 추가

이 원본으로 배우는 학습용 에이전트

이 원본은 수집 단계입니다. 한국어 학습 패키지와 직무별 적용 기준은 아직 편집하지 않았습니다.