PLASTIC: Improving Input and Label Plasticity for Sample Efficient Reinforcement Learning
KAIST · NeurIPS 2023 · 2023 · 검증 완료 검증 완료복수의 신뢰 가능한 출처로 검증되었습니다.
강화학습 표본 효율을 위해 입력 가소성과 라벨 가소성을 구분하고 손실 지형 평탄화와 그래디언트 전파 개선을 결합한 PLASTIC 기법.
- arXiv
- 2306.10711
- 원문
- https://arxiv.org/abs/2306.10711
관련 항목
출처 및 검증
- [paper] https://arxiv.org/abs/2306.10711
마지막 검증일: 2026-07-22