Same Trajectory, Contradictory Rewards (ROBORMBENCH): Paraphrase Fragility in Vision Language Reward Models
Yonsei University · Carnegie Mellon University · Seoul National University · arXiv · 2026 · 검증 완료 검증 완료복수의 신뢰 가능한 출처로 검증되었습니다.
같은 로봇 궤적의 의미가 같은 목표 문장 표현만 바뀌어도 VLM 보상이 달라지는 문제를 측정한다. 실제 로봇 궤적 2,390개와 검증된 패러프레이즈 21,673개로 ROBORMBENCH를 구성해 모델 규모와 명시적 추론만으로는 패러프레이즈 불변성이 보장되지 않음을 보인다.
- arXiv
- 2609.05401
- 원문
- https://arxiv.org/abs/2609.05401
관련 항목
출처 및 검증
- [paper] https://arxiv.org/abs/2609.05401
마지막 검증일: 2026-09-16