arxiv-wiki

Learning to Fuse LLMs with Ontology Rankers for Rare-Disease Diagnosis

← 2026-09-03 목록으로 돌아가기

주요 Figure

원문 PDF에서 실제 Figure 캡션과 그림 영역이 함께 확인된 자료만 자동 추출했다.

Figure 1: Fusion proceeds in three stages. (a) The ontology ranker and the LLM independently construct disease

Figure · 원문 PDF 4쪽 · Figure 1: Fusion proceeds in three stages. (a) The ontology ranker and the LLM independently construct disease

Figure 2: Recall@1 by the source-exclusive fraction of

Figure · 원문 PDF 19쪽 · Figure 2: Recall@1 by the source-exclusive fraction of

한 문장 요약

LLM의 자유 생성 진단과 HPO 기반 온톨로지 랭커의 증거를 결합하는 행동 기반 게이트를 학습해 사례별로 두 시스템의 가중치를 조정함으로써 희귀질환 진단 성능을 높이고 후보별 온톨로지 증거를 보존한다.

해결하려는 문제

희귀질환 진단에서 전통적 온톨로지 기반 랭커(예: Phenomizer)는 후보 질환마다 HPO 매칭과 통계적 점수로 근거를 제공해 임상에서 중요하지만, 최신 LLM은 환자 기술로 직접 차등진단을 생성해 후보 확장 측면에서 유리할 수 있으나 근거 추적(evidence trail)이 부족하고 환자별 행동이 달라 어느 시스템을 신뢰할지 사례별 결정이 어렵다. 또한 벤치마크 편향(테스트 사례와 HPOA 주석이 동일 출판물에서 유래하는 publication-source overlap)이 랭커 성능을 과대평가할 수 있다. 연구질문은 LLM이 온톨로지 랭커의 증거 가능성을 유지하면서 랭커 성능을 향상시킬 수 있는가, 그리고 새로운(학습에 사용되지 않은) LLM에 대해 학습된 게이트를 전이할 수 있는가이다.

핵심 기여

접근 방법

주요 결과

한계

개발자 관점

근거 범위: 논문 PDF 본문(제공된 텍스트: 본문과 부록 포함)을 기반으로 요약·분석함. 표와 본문에서 제시된 수치(Recall@1, 증분, 데이터셋 분할, 모델·하이퍼파라미터 등)는 PDF에 명시된 값을 그대로 사용함. 외부 코드·저장소 실행 결과나 PDF에 없던 구현 세부(예: 내부 랜덤 시드별 미세 동작)는 생성하지 않았음.