프로젝트 배경
1) 문제점 - 전문 PDF 문서를 영상 콘텐츠로 전환하려면 문서 분석, 대본 작성, 장면 구성, 음성 제작, 영상 편집까지 여러 작업을 순차적으로 진행해야 합니다. - 사람이 모든 단계를 직접 처리하면 반복 작업이 많고 제작 시간이 길어집니다. - 생성형 AI를 사용하더라도 각 단계를 개별적으로 사용하는 것만으로는 하나의 영상 제작 Workflow로 연결하기 어렵습니다. 2) 프로젝트 목표 -
프로젝트 성과
PDF 1건에서 6개 Scene의 최종 MP4 영상 생성
12페이지 PDF를 분석해 Storyboard·TTS·장면 영상을 생성하고, 6개 Scene을 결합한 25.8초 MP4를 완성·재생 검증했습니다.
핵심 기능
진행 단계
PDF 분석 및 구조화
2026.09.
12페이지 PDF에서 텍스트를 추출하고, Gemini로 섹션·핵심 정보·출처 페이지를 구조화했습니다.
프로젝트 상세
1) 포트폴리오 소개 전문 PDF 문서를 입력받아 내용을 분석하고, 영상용 스토리보드와 음성을 생성한 뒤 최종 MP4 영상으로 제작하는 AI 문서→영상 자동화 Workflow를 기술검증한 PoC 프로젝트입니다. 2) 작업 범위 - PDF 문서 텍스트 추출 및 페이지 단위 구조화 - Gemini를 활용한 문서 내용 분석 및 핵심 정보 구조화 - 원문 근거를 유지한 영상 스토리보드 JSON 생성 -






