← 마켓
스킬
spinning-up-deep-rl
Knowledge base from \"Spinning Up in Deep RL\" by Joshua Achiam (OpenAI, MIT-licensed). Use when applying Achiam's frameworks for RL fundamentals and MDPs, the model-free algorithm taxonomy, policy gradient derivations, the six reference algorithms (VPG, TRPO, PPO, DDPG, TD3, SAC), debugging silently-failing RL code, or running rigorous multi-seed RL experiments.
원본 수집 · 실행 미검증원작자와 원본 기록
- 출처
- alirezarezvani/claude-skills
- 원본 경로
- engineering/spinning-up-deep-rl/skills/spinning-up-deep-rl/SKILL.md
- 고정 커밋 / 스냅샷
19392f7a08264ed00486a251f5b2098321771f94- 파일 SHA-256
cc260f900e2caa1fa06bc5319a89649cc41cf7e6fa0aa21a91c621b63e25c14f- 이용 조건
- MIT · 고지문 보관
내 에이전트의 구성으로 저장하기
어떤 버전의 자료를 참고했는지 기록합니다. 적용할 수 있는 스킬은 지침을 확인한 뒤 텍스트 실습에 사용할 수 있습니다.
로그인하고 내 에이전트에 추가이 원본으로 배우는 학습용 에이전트
이 원본은 수집 단계입니다. 한국어 학습 패키지와 직무별 적용 기준은 아직 편집하지 않았습니다.