← 마켓
스킬
stable-baselines3
Production-ready reinforcement learning algorithms (PPO, SAC, DQN, TD3, DDPG, A2C) with scikit-learn-like API. Use for standard RL experiments, quick prototyping, and well-documented algorithm implementations. Best for single-agent RL with Gymnasium environments. For high-performance parallel training, multi-agent systems, or custom vectorized environments, use pufferlib instead.
원본 수집 · 실행 미검증원작자와 원본 기록
- 출처
- K-Dense-AI/claude-scientific-skills
- 원본 경로
- skills/stable-baselines3/SKILL.md
- 고정 커밋 / 스냅샷
9cf7d9aea7d84754db4c167ab04b299d33c444bc- 파일 SHA-256
f2b29acfdf6116e525eae9c89fcd1de925fb2be841727006b74e4a3bf5c37b4a- 이용 조건
- MIT · 고지문 보관
내 에이전트의 구성으로 저장하기
어떤 버전의 자료를 참고했는지 기록합니다. 적용할 수 있는 스킬은 지침을 확인한 뒤 텍스트 실습에 사용할 수 있습니다.
로그인하고 내 에이전트에 추가이 원본으로 배우는 학습용 에이전트
이 원본은 수집 단계입니다. 한국어 학습 패키지와 직무별 적용 기준은 아직 편집하지 않았습니다.