AI 기반 문서 영상 자동 생성 워크플로우
전문 PDF 문서 한 건을 설명 영상으로
자동 변환합니다
문서를 업로드하면 LLM이 내용을 분석해 대본과 스토리보드를 만들고, 이미지·영상 생성 AI와 TTS를 결합해 30초~1분 분량의 MP4 설명 영상을 자동으로 완성합니다.
1. 문서 업로드
분석할 전문 PDF 문서 1건을 업로드하세요. 드래그 앤 드롭을 지원합니다.
여기에 PDF 파일을 드래그 앤 드롭하거나 클릭하여 업로드하세요
PDF 형식 · 1건 · 최대 50MB (프로토타입에서는 파싱 결과가 샘플 데이터로 대체됩니다)
Drag & Drop
PDF 확장자 검증
단일 문서 입력
2. 영상 생성 옵션
시청자 수준과 영상 길이에 따라 대본의 깊이와 씬 구성이 달라집니다.
시청자 이해 수준
대본의 어휘와 설명 깊이가 달라집니다영상 길이
길이에 따라 씬 구성이 자동 조정됩니다체크하면 4단계(시각 자료 생성)에서 API 호출 실패를 발생시키고, 자동 재시도 후 정상 진행되는 예외 처리 로직을 확인할 수 있습니다.
생성 요약
설정한 옵션으로 아래와 같이 생성됩니다.
- 입력 문서
- 업로드 대기 중
- 시청자 수준
- General Level
- 영상 길이
- 30초
- 예상 씬 수
- 5개 씬
- 출력 포맷
- MP4 · 1920×1080 · 30fps
- 오류 시뮬레이션
- 미사용
PDF 문서를 업로드하면 활성화됩니다.
프로토타입에서는 실제 API 호출 없이 정해진 시나리오로 진행되며, 결과물은 미리 준비된 샘플 데이터입니다.
생성 파이프라인에서 자동으로 수행되는 작업
PDF 파싱 · 구조화
텍스트 · 표 · 도면을 섹션 트리로 정리
LLM 대본 생성
GPT · Claude · Gemini 연동, 원문 근거 검증
스토리보드 자동 구성
씬 분할 · 타임코드 · 전환 설계
TTS · 자막 생성
음성 합성 및 SRT/VTT 자막 동시 산출
FFmpeg / Remotion 합성
씬별 동기화 후 MP4 자동 렌더링
다국어 확장 구조
한국어 · 영어 데이터 구조 기본 내장