arxiv-wiki

RATIO: A Benchmark for Retrieval Across Typed Ideation Operations in Scientific Literature

← 2026-08-30 목록으로 돌아가기

주요 Figure

원문 PDF에서 실제 Figure 캡션과 그림 영역이 함께 확인된 자료만 자동 추출했다.

Figure 1: We construct RATIO from full-text scien-

Figure · 원문 PDF 1쪽 · Figure 1: We construct RATIO from full-text scien-

Figure 2: Construction of RATIO. Validated discourse markers identify ADDRESS, BROADEN, and SPECIFY

Figure · 원문 PDF 3쪽 · Figure 2: Construction of RATIO. Validated discourse markers identify ADDRESS, BROADEN, and SPECIFY

Figure 3: Worked extraction example, including marker removal and cleaning of the query–marker–positive triple.

Figure · 원문 PDF 15쪽 · Figure 3: Worked extraction example, including marker removal and cleaning of the query–marker–positive triple.

한 문장 요약

과학 문헌에서 ‘문제에 대한 해결 제안(ADDRESS)’, ‘더 일반화된 서술(BROADEN)’, ‘구체적 사례 제시(SPECIFY)’의 세 가지 발상(ideation) 연산에 따른 관련성 판단을 목표로, 문장초기 담화표지(disourse markers)를 이용한 대규모 원격 지도학습 파이프라인과 LLM·인간 검증을 결합해 RATIO 벤치마크와 평가 절차를 제시한다.

해결하려는 문제

기존 학술 검색/검색성 평가 벤치마크는 주로 주제적·정보적 관련성(문서가 질의에 답하는지)을 다루며, ‘문헌이 발상(inspiration)으로 어떤 역할을 하는가(문제를 직접 해결하는 제안인지, 더 일반화된 관점인지, 구체적 사례인지)’ 같은 역할별(relation-conditioned) 관련성은 다루지 못한다. 이로 인해 문헌기반 연구 보조 시스템이 제공해야 할 다양한 ‘아이디어 이동(ideation moves)’을 포착하는 검색 구성요소를 학습·평가할 수 없고, 대규모·정확한 감독(supervision)을 얻는 방법과 평가 절차도 부재하다.

핵심 기여

접근 방법

주요 결과

한계

개발자 관점

근거 범위: 이 분석은 제공된 논문 PDF 본문(본문 및 부록 텍스트)을 근거로 작성했다. 수치(데이터셋 크기, 평가 지표, 모델·하이퍼파라미터 요약 등)는 본문 표와 설명에서 직접 인용하였다. PDF의 일부 구현 세부(예: 내부 코드·정밀 하드웨어 로그)는 본문에 명시되지 않아 기술하지 않았으며, 추가 세부는 논문의 부록·공개 저장소를 참조해야 한다.