Agents Trust Tools Too Much: Measuring Reliance on Unreliable Tools

Seoul National University · arXiv · 2026 · 검증 완료 검증 완료복수의 신뢰 가능한 출처로 검증되었습니다.

웹 검색·하위 LLM 에이전트·코드 실행 도구의 반환값을 오염시켜 14개 LLM 에이전트가 잘못된 내용을 최종 답에 채택하는지 측정한다. 모든 도구에서 평균 채택률이 3분의 1을 넘었으며, 내부 추론에서 충돌을 인지하고도 사용자에게 경고하지 않는 도구 과신 실패를 확인한다.

arXiv
2609.05587
원문
https://arxiv.org/abs/2609.05587

관련 항목

출처 및 검증

마지막 검증일: 2026-09-16

✎ 정보 수정 제안