arxiv-wiki

OmniScientist: An Omni-Modal Omni-Discipline AI Scientist

← 2026-08-15 목록으로 돌아가기

주요 Figure

원문 PDF에서 실제 Figure 캡션과 그림 영역이 함께 확인된 자료만 자동 추출했다.

Figure 1. Overview of the OmniScientist framework. Raw multimodal observations spanning multiple disciplines (left) are

Figure · 원문 PDF 1쪽 · Figure 1. Overview of the OmniScientist framework. Raw multimodal observations spanning multiple disciplines (left) are

Figure 2. Progression from raw evidence to verified findings across three demonstration cases. The top three rows track

Figure · 원문 PDF 5쪽 · Figure 2. Progression from raw evidence to verified findings across three demonstration cases. The top three rows track

Figure 3. Architecture of the OmniScientist framework. At the top, raw evidence from multiple disciplines enters the

Figure · 원문 PDF 7쪽 · Figure 3. Architecture of the OmniScientist framework. At the top, raw evidence from multiple disciplines enters the

한 문장 요약

OmniScientist는 원시 멀티모달 증거를 직접 인식하는 인지(Perception)-우선의 멀티에이전트 파이프라인으로, 아이디에이션·실험·작성의 세 에이전트와 코드로 강제되는 idea/rigour/claim 체크를 결합해 증거-추적가능한 전주기(데이터→논문) 자동 연구를 실행한다.

해결하려는 문제

기존 ‘AI 과학자’들은 워크플로우(가설→실험→작문)를 자동화했지만 원시 관측(이미지, 신호, 영상, 3D, 궤적 등)에 내재한 공간·시간·교차채널·절차적 관계를 잃은 전처리된 요약(텍스트/스칼라 피처/라벨 등)을 주로 사용했다. 이로 인해 에이전트가 감지·가설화·실험설계·결론근거에 필요한 핵심 증거 구조를 놓치고, HARKing·데이터 유출·다중비교 오용 같은 문제에 취약하며 최종 주장의 증거 추적성(provenance)과 재현성이 약화되는 한계가 있다.

핵심 기여

접근 방법

주요 결과

한계

개발자 관점

근거 범위: 이 분석은 제공된 논문 PDF 본문(주요 본문, 표와 알고리즘, 부록 일부 포함)에서 직접 확인한 내용만을 근거로 작성했다. 표(Table 1–19), 알고리즘(Algorithm 1–2), 그림 설명과 본문 서술에서 추출한 수치·정책·통계만 사용했으며, PDF에 포함되지 않았거나 명시적 근거가 없는 구현 세부사항·추정 수치는 포함하지 않았다. 일부 추가 구현·평가 세부사항(예: 소스코드의 내부 함수명/구성, 외부 인프라 비용)은 본문에 제한적으로만 기술되어 있어 일반화하거나 보충하지 않았다.