arxiv-wiki

GradCuit: Credit-Assigned Gradient Flow Enables Robust and Interpretable Test-Time Latent Reasoning

한 문장 요약

GradCuit은 Transformer 내부의 연속 잠재 상태를 테스트 시점에 최적화하고, 생성 토큰의 로그확률에 직접 경사를 연결해 잠재 추론의 견고성과 해석가능성을 높이는 방법이다.

해결하려는 문제

기존의 테스트-타임 latent reasoning 방법은 잠재 변수를 디코딩된 토큰과의 인터페이스로 연결해 크레딧 할당이 간접적이고, 잠재 업데이트가 이후 추론에 어떤 경로로 영향을 주는지 해석하기 어렵다는 한계가 있다. 이로 인해 추론 경로의 해석성·안정성 문제와 토큰-잠재 간의 정보 흐름의 불투명성이 나타난다. 연구 질문은 토큰 디코딩을 거치지 않고도, Transformer의 내부 잠재 상태에 직접 크레딧을 할당하며 해석 가능하고 견고한 테스트-타임 잠재 추론을 구현할 수 있는가이다.

핵심 기여

접근 방법

주요 결과

한계

개발자 관점

주요 Figure

원문 PDF에서 실제 Figure 캡션과 그림 영역이 함께 확인된 자료만 자동 추출했다.

Figure 1: The GRADCUIT framework. The Transformer’s self-attention mechanism functions as a

Figure · 원문 PDF 2쪽 · Figure 1: The GRADCUIT framework. The Transformer’s self-attention mechanism functions as a

Figure 2: Learning-rate

Figure · 원문 PDF 6쪽 · Figure 2: Learning-rate

Figure 3: Average accuracy across three represen-

Figure · 원문 PDF 6쪽 · Figure 3: Average accuracy across three represen-

주요 Figure

원문 PDF에서 실제 Figure 캡션과 그림 영역이 함께 확인된 자료만 자동 추출했다.

Figure 1: The GRADCUIT framework. The Transformer’s self-attention mechanism functions as a

Figure · 원문 PDF 2쪽 · Figure 1: The GRADCUIT framework. The Transformer’s self-attention mechanism functions as a

Figure 2: Learning-rate

Figure · 원문 PDF 6쪽 · Figure 2: Learning-rate

Figure 3: Average accuracy across three represen-

Figure · 원문 PDF 6쪽 · Figure 3: Average accuracy across three represen-

근거 범위: 논문 PDF 본문 기반 분석. 본문 1~19쪽에 걸친 주요 본문과 실험 섹션의 내용에 의거해 요약했다. 다만 구현 세부사항은 Appendix-A에 상세히 제시되므로 재현 시 Appendix를 참조해야 하며, 한계와 외부 일반화에 대한 논의는 본문에 제한적으로 명시되어 있어 해석 가능 범위에 주의가 필요하다.