arxiv-wiki

Can Large Language Models Explain Flight Safety Events? A Prior-Guided Semantic LLM-based Approach

← 2026-08-19 목록으로 돌아가기

한 문장 요약

QAR 시계열을 통계·물리 특성으로 압축하고 양적 값을 의미 단위로 이산화한 뒤 CatBoost의 예측을 프롬프트로 주입해 LLM에게 대비적 few-shot 맥락과 구조화된 지식프롬프트로 하드랜딩 분류와 원인 설명을 수행하는 FlightLLM을 제안한다.

해결하려는 문제

목표는 QAR(Quick Access Recorder) 다변량 시계열에서 단순 탐지 수준을 넘어 조종사의 조종행동 수준에서 비행 안전사건(본 논문에서는 하드랜딩)의 원인을 일관되게 설명하는 것이다. 기존 기계학습·딥러닝 기반 방법들은 높은 분류 성능을 보이나 내부 가중치·어텐션 시각화는 도메인 전문가의 해석을 필요로 하며 인간이 이해 가능한 인과 서사를 직접 생성하지 못한다. LLM을 활용할 수 있으나 다음의 핵심 문제들이 존재한다: (1) QAR의 수치적·다중주파수 시계열과 LLM의 언어 토크나이저 사이의 모달 불일치(숫자 처리 및 연속성 손실), (2) LLM의 본질적 분류능력 한계, (3) 희귀 사건으로 인한 태스크 특화 데이터 부족(미세조정 곤란), (4) 일반 목적 LLM의 항공 도메인 지식 부족과 환각 위험.

핵심 기여

접근 방법

주요 결과

한계

개발자 관점

근거 범위: 이 분석은 제공된 논문 PDF 본문(페이지 1–14)에 기반해 작성되었음. 수치는 본문 표와 본문 기술(데이터셋 크기, 임계값 θ=1.5g, 샘플 수 282/422, 모델별 성능 표 IV, ablation 표 V 등)에서 직접 추출함. 다만 CatBoost·TSFresh의 세부 하이퍼파라미터, TSFresh의 top-k 수치, LLM 프롬프트의 완전 원문(일부는 도식/요약으로 제시됨) 등은 PDF에 구체값이 없어 재현을 위해선 저자 코드·부록이나 추가 정보가 필요함.