Beneath the Surface of Chains-of-Thought: A Mechanistic Interpretation of Reasoning Operations in LLMs

KAIST · NAVER AI Lab · EMNLP 2026 Main Conference · 2026 · 검증 완료 검증 완료복수의 신뢰 가능한 출처로 검증되었습니다.

문제 정식화·목표 분해·연역 등 사고과정 연산이 LLM 은닉표현 공간에서 구분되는지 분석한다. 연산 분리도가 중간 층에서 가장 높고 어휘·위치 혼입만으로 설명되지 않으며, 같은 표면 토큰도 주변 추론 연산에 따라 다르게 표현됨을 보인다.

arXiv
2609.04753
원문
https://arxiv.org/abs/2609.04753

관련 항목

출처 및 검증

마지막 검증일: 2026-09-16

✎ 정보 수정 제안