arxiv-wiki

MemTrapBench: Benchmarking Cognitive Traps in LLM Memory Use

← 2026-08-22 목록으로 돌아가기

주요 Figure

원문 PDF에서 실제 Figure 캡션과 그림 영역이 함께 확인된 자료만 자동 추출했다.

Figure 1: Memory is not always what you need. (a) With-

Figure · 원문 PDF 1쪽 · Figure 1: Memory is not always what you need. (a) With-

Figure 2: Overview of our MemTrapBench construction.

Figure · 원문 PDF 3쪽 · Figure 2: Overview of our MemTrapBench construction.

Figure 3: Representative examples from our MemTrapBench.

Figure · 원문 PDF 4쪽 · Figure 3: Representative examples from our MemTrapBench.

한 문장 요약

메모리 사용이 LLM의 추론과 신념을 왜곡하여 성능을 저하시킬 수 있음을 규명하고, 이를 진단하는 데이터셋 MemTrapBench와 추론시 프롬프트 기반 완화 기법 AdaptiveMem을 제안한다.

해결하려는 문제

기존 메모리 벤치마크는 정보 추출·저장·검색의 정확성에 주로 초점을 맞추지만, 검색된 메모리가 현재 과제에서 모델의 추론 전략과 신념을 어떻게 재구성하여 성능을 저하시킬 수 있는지를 평가하지 못한다. 본문은 ‘메모리 사용 자체가 동일한 쿼리에서 메모리 비사용(no-memory)보다 성능을 낮출 수 있는’ 메모리 유도 인지 함정(Memory Traps)을 정의하고, 이를 체계적으로 진단할 수 있는 벤치마크와 완화 방법을 제시한다.

핵심 기여

접근 방법

주요 결과

한계

개발자 관점

근거 범위: 이 분석은 제공된 논문 PDF 본문(본문 및 표, 그림 설명)을 기반으로 작성되었다. 데이터셋 통계(1,050개, 시나리오별 개수), 테이블(1–5) 및 본문에서 명시된 수치(예: no-memory 및 메모리 전략별 점수, 메모리 길이 ablation, AdaptiveMem 개선치)를 직접 인용하였다. 본문에서 상세 구현 프롬프트와 보조자료에 포함된 내용은 언급되었으나 PDF 본문에 완전한 프롬프트 텍스트가 포함되지 않아 해당 세부 프롬프트 문구는 본 분석에 포함하지 않았다.