Accelerating Reinforcement Learning with Value-Conditional State Entropy Exploration
KAIST · NeurIPS 2023 · 2023 · 검증 완료 검증 완료복수의 신뢰 가능한 출처로 검증되었습니다.
상태 엔트로피 탐색이 과제 보상과 결합될 때의 저가치 편향을 해결하는 가치 조건부 상태 엔트로피(VCSE)를 제안.
- arXiv
- 2305.19476
- 원문
- https://arxiv.org/abs/2305.19476
관련 항목
출처 및 검증
- [paper] https://arxiv.org/abs/2305.19476
마지막 검증일: 2026-07-22