← 마켓
스킬

spinning-up-deep-rl

Knowledge base from \"Spinning Up in Deep RL\" by Joshua Achiam (OpenAI, MIT-licensed). Use when applying Achiam's frameworks for RL fundamentals and MDPs, the model-free algorithm taxonomy, policy gradient derivations, the six reference algorithms (VPG, TRPO, PPO, DDPG, TD3, SAC), debugging silently-failing RL code, or running rigorous multi-seed RL experiments.

원본 수집 · 실행 미검증

원작자와 원본 기록

출처
alirezarezvani/claude-skills
원본 경로
engineering/spinning-up-deep-rl/skills/spinning-up-deep-rl/SKILL.md
고정 커밋 / 스냅샷
19392f7a08264ed00486a251f5b2098321771f94
파일 SHA-256
cc260f900e2caa1fa06bc5319a89649cc41cf7e6fa0aa21a91c621b63e25c14f
이용 조건
MIT · 고지문 보관

내 에이전트의 구성으로 저장하기

어떤 버전의 자료를 참고했는지 기록합니다. 적용할 수 있는 스킬은 지침을 확인한 뒤 텍스트 실습에 사용할 수 있습니다.

로그인하고 내 에이전트에 추가

이 원본으로 배우는 학습용 에이전트

이 원본은 수집 단계입니다. 한국어 학습 패키지와 직무별 적용 기준은 아직 편집하지 않았습니다.