arxiv-wiki

DFM Mimir v1: An Open HRM Delivering Frontier Performance at 1B Parameters Using Only Permissible Post-Training Data

← 2026-08-14 목록으로 돌아가기

주요 Figure

원문 PDF에서 실제 Figure 캡션과 그림 영역이 함께 확인된 자료만 자동 추출했다.

Figure 1: Aggregate results comparing DFM Mimir 1B against the HRM-Text 1B, Qwen 3.5 2B and

Figure · 원문 PDF 1쪽 · Figure 1: Aggregate results comparing DFM Mimir 1B against the HRM-Text 1B, Qwen 3.5 2B and

한 문장 요약

HRM-Text 기반의 1B 파라미터 언어모델 Mimir v1을 허용된(퍼미시블) 후처리 데이터만으로 학습·공개하여 덴마크어에서 최첨단 성능을 달성하고 영어·수학·코드 과제에서도 경쟁력 있는 성능을 보임.

해결하려는 문제

현행 대형 언어모델 개발은 대규모이면서 종종 비허용(저작권·개인정보 포함) 데이터에 의존해 오픈·윤리적 데이터만 사용하려는 연구자·프로젝트(예: 덴마크 재단 모델 프로젝트)에 높은 진입 장벽을 만든다. 덴마크어처럼 자원이 적은 언어에서는 허용 가능한 데이터만으로도 실용적이고 경쟁력 있는 베이스 모델을 학습하는 것이 어렵다. 본 연구는 ‘허용 가능한’ 데이터 한정하에, 사전학습(또는 초기 학습)과정에서 실무에 쓸 수 있는 성능을 내는 1B 모델을 만드는 문제를 다룬다.

핵심 기여

접근 방법

주요 결과

한계

개발자 관점

근거 범위: 이 분석은 제공된 논문 PDF 본문(페이지 1–20, 본문·표·부록 포함)을 근거로 작성되었음. 본문에 명시된 수치(토큰 수, 하이퍼파라미터, 평가 점수, 학습 스펙 등)를 그대로 인용하였고, 저자가 직접 명시하지 않은 세부 구현·감소된 수치(예: 총 GPU 시간(kGPUh) 또는 전력·비용 추정)는 생성하지 않았다. 계약상 공개 불가 데이터 항목과 합성 데이터의 감사 세부 기준은 본문에 일반적으로 서술되어 있으나 감사의 정밀한 절차·통계(예: 카테고리별 acceptance rate 수치)는 데이터군별로 ‘다름’만 언급되어 있어 구체 수치는 포함하지 않았음.