프로젝트 배경
1) 문제점 - 영상 한 편에 대본, 나레이션 녹음, 편집, 썸네일까지 수 시간이 드는 노동집약 작업 - 특히 음성과 화면 전환의 싱크를 손으로 맞추는 편집이 가장 큰 병목 - 정기 발행을 하려면 매일 같은 작업을 반복해야 해서 지속하기 어려움 2) 프로젝트 목표 - 대본만 확정되면 나레이션 합성, 씬 타이밍, 렌더링, 썸네일까지 코드로 자동 생성 - 롱폼과 숏폼을 같은 파이프라인에서 포맷만 바
프로젝트 성과
음성-화면 타이밍 자동 싱크 구현
나레이션 음성 길이에 맞춰 씬 타이밍을 자동 계산하고 합성해, 수동 편집 병목을 제거했습니다.
유튜브 채널 실운영 검증
롯폼·숫폼·에버그린 콘텐츠 15편 이상을 실제 발행하며 파이프라인 안정성을 확인했습니다.
발행 패키지 자동 생성
영상·썸네일·트레일러 숫폼·제목 A/B안·챕터 타임스탬프까지 한 번에 산출돼 발행 준비 시간을 줄였습니다.
핵심 기능
진행 단계
TTS 합성 및 대본 파싱 구축
2026.03.
상업용 TTS API를 연동하고 호흡·속도 제어와 마크다운 대본 파싱 구조를 확립했습니다.
프로젝트 상세
1) 포트폴리오 소개 - 서비스 카테고리: 영상 제작 자동화 / AI 음성(TTS) / 콘텐츠 파이프라인 - 메인 타깃: 정기적으로 영상 콘텐츠를 발행해야 하는 채널과 브랜드 (자체 채널 운영으로 검증) > 간략 소개: 대본을 입력하면 AI 나레이션 합성, 씬 자동 배치, 렌더링, 썸네일과 업로드 정보까지 자동으로 생성되는 영상 제작 파이프라인을 구축해 실제 채널을 운영하고 있습니다. 2) 작업







