arxiv-wiki

How LLMs Build Fictional Worlds: Setting and Narrative Space in AI-Generated Creative Storytelling

← 2026-09-03 목록으로 돌아가기

주요 Figure

원문 PDF에서 실제 Figure 캡션과 그림 영역이 함께 확인된 자료만 자동 추출했다.

Figure 1: The same opening sentence (bold) continued

Figure · 원문 PDF 1쪽 · Figure 1: The same opening sentence (bold) continued

Figure 2: Normalized frequencies of setting categories

Figure · 원문 PDF 6쪽 · Figure 2: Normalized frequencies of setting categories

Figure 3: Deviation of model predictions from the human baseline for perceived and action space across narrative

Figure · 원문 PDF 8쪽 · Figure 3: Deviation of model predictions from the human baseline for perceived and action space across narrative

한 문장 요약

LLM이 생성한 장편 소설 생성물의 ‘설정(setting)’을 서사학적 범주(액션·감응·시각·서술·무공간)로 자동 분류해, 영어·독일어로 생성된 8,000편(모델별 1,000편)과 Project Gutenberg 원전 샘플을 비교·분석한 연구로, 미세조정된 BERT 계열 분류기(영어: RoBERTa 기반)를 사용해 문장 단위 공간 분포와 시간적 추이를 통계모형(GLMM)으로 검증했다.

해결하려는 문제

기존 연구는 LLM 생성 문학의 창의성·품질 평가나 감정·플롯 등 일부 속성에 집중했고, ‘설정(setting)’이라는 서사적·공간적 세계구축 차원은 체계적으로 정량화·비교된 바 없다. 본 연구는 (1) 서사 공간을 서사학적으로 다섯 범주로 정의·측정할 수 있는가, (2) 최근 LLM들이 인간 저작과 비교해 어떤 세계구축(공간 사용) 패턴을 보이는가, (3) 모델·언어별·서사시간별로 차이가 존재하는지 등을 규명한다.

핵심 기여

접근 방법

주요 결과

한계

개발자 관점

근거 범위: 이 분석은 제공된 논문 PDF 본문(주요 본문 및 부록 A–I 포함) 근거로 작성되었다. 수치는 본문과 부록에 명시된 값을 그대로 사용했으며(예: 표·그림·테이블의 수치, 분류기 성능, 생성 텍스트 수·길이), 논문에 명시되지 않은 구현비용·구체적 하이퍼파라미터(예: 정확한 배치사이즈, 학습 데이터 전체 크기 외 세부 전처리)는 본문에 없으므로 추정하지 않았다.