Agents Trust Tools Too Much: Measuring Reliance on Unreliable Tools
Seoul National University · arXiv · 2026 · 검증 완료 검증 완료복수의 신뢰 가능한 출처로 검증되었습니다.
웹 검색·하위 LLM 에이전트·코드 실행 도구의 반환값을 오염시켜 14개 LLM 에이전트가 잘못된 내용을 최종 답에 채택하는지 측정한다. 모든 도구에서 평균 채택률이 3분의 1을 넘었으며, 내부 추론에서 충돌을 인지하고도 사용자에게 경고하지 않는 도구 과신 실패를 확인한다.
- arXiv
- 2609.05587
- 원문
- https://arxiv.org/abs/2609.05587
관련 항목
출처 및 검증
- [paper] https://arxiv.org/abs/2609.05587
마지막 검증일: 2026-09-16