arxiv-wiki

CritICL: Inference-Time Weak-to-Strong Generalization from Small Language Model Failure Modes

← 2026-08-28 목록으로 돌아가기

주요 Figure

원문 PDF에서 실제 Figure 캡션과 그림 영역이 함께 확인된 자료만 자동 추출했다.

Figure 1: CritICL is a two-stage, inference-time W2SG method. Stage 1: Construct CritBank.

Figure · 원문 PDF 2쪽 · Figure 1: CritICL is a two-stage, inference-time W2SG method. Stage 1: Construct CritBank.

Figure 2: Failure mode distributions across model scales remains highly consistent across

Figure · 원문 PDF 8쪽 · Figure 2: Failure mode distributions across model scales remains highly consistent across

한 문장 요약

작은 모델의 체계적 실패 모드를 오프라인으로 수집한 CritBank의 비판(critique) 예시를 인-컨텍스트로 재사용하여, 동적/정적 검색 전략으로 강한 모델의 추론 성능을 비용 효율적으로 향상시키는 CritICL 프레임워크를 제안한다.

해결하려는 문제

기존의 추론 시 스케일링 방법들은 반복 생성(self-consistency 등)이나 외부 검증(LLM-as-judge)처럼 다수의 생성 또는 보조 모델 호출을 요구해 추론 비용이 크다. 또한 약한 모델을 온라인으로 보조 지도로 사용하는 기존 W2S(weak-to-strong) 접근은 입력마다 약한 모델을 호출해야 하며 약한 모델의 직접 출력 품질에 의존한다. 본 연구는 동일 계열 내에서 약·강 모델이 공유하는 체계적 실패 모드를 활용해, 추가적인 반복 생성 없이(또는 최소한으로) 강한 모델의 추론을 개선할 수 있는지 묻는다.

핵심 기여

접근 방법

주요 결과

한계

개발자 관점

근거 범위: 이 분석은 제공된 논문 PDF 본문(본문, 표, 부록 발췌)을 근거로 작성되었다. 제시된 수치, 표값, 알고리즘 및 프롬프트는 PDF에 명시된 내용을 그대로 인용했다. 다만 구현 세부사항(예: K/T의 정확한 기본값 일부, 내부 파이프라인의 최종 미세튜닝 등)이나 외부 코드·환경(저자가 공개한 코드의 최신 변경사항)은 PDF 본문만으로는 검증할 수 없어 언급을 자제했다.