State Entropy Maximization with Random Encoders for Efficient Exploration
KAIST · ICML 2021 · 2021 · 검증 완료 검증 완료복수의 신뢰 가능한 출처로 검증되었습니다.
고정 무작위 인코더 표현 위 k-최근접 이웃으로 상태 엔트로피를 추정해 내재 보상으로 쓰는 RE3 탐색 기법.
- arXiv
- 2102.09430
- 원문
- https://arxiv.org/abs/2102.09430
관련 항목
출처 및 검증
- [paper] https://arxiv.org/abs/2102.09430
마지막 검증일: 2026-07-22