Beneath the Surface of Chains-of-Thought: A Mechanistic Interpretation of Reasoning Operations in LLMs
KAIST · NAVER AI Lab · EMNLP 2026 Main Conference · 2026 · 검증 완료 검증 완료복수의 신뢰 가능한 출처로 검증되었습니다.
문제 정식화·목표 분해·연역 등 사고과정 연산이 LLM 은닉표현 공간에서 구분되는지 분석한다. 연산 분리도가 중간 층에서 가장 높고 어휘·위치 혼입만으로 설명되지 않으며, 같은 표면 토큰도 주변 추론 연산에 따라 다르게 표현됨을 보인다.
- arXiv
- 2609.04753
- 원문
- https://arxiv.org/abs/2609.04753
관련 항목
출처 및 검증
- [paper] https://arxiv.org/abs/2609.04753
- [github] https://github.com/naver-ai/beneath-cot
마지막 검증일: 2026-09-16