본문으로 건너뛰기

AI 도구로 완성한 Pluribus 장면 편집

gpt-6 astra와 음성·립싱크 도구를 결합해 Pluribus 장면을 편집하고 자막은 수동으로 마무리했습니다.

이 요약은 AI가 원문을 분석해 생성했습니다. 정확한 내용은 원문 기준으로 확인하세요.

TL;DR

게시자는 Pluribus의 한 장면을 바탕으로 편집 영상을 제작하고, 그 과정에 여러 AI 도구와 직접적인 영상 처리 방식을 결합했습니다. gpt-6 astra가 편집 작업에서 FFmpeg를 직접 사용했고, elevenlabs는 음성 생성에, fal.ai의 립싱크 모델은 입 모양과 음성 정합에 활용됐습니다. 완성된 영상에 자막을 넣는 작업은 자동화하지 않고 Descript에서 수동 후처리로 진행했습니다. 생성 모델이 모든 제작 단계를 독점하기보다 음성·립싱크·편집·자막을 서로 다른 도구로 나눈 제작 흐름이 핵심입니다.

실용적 조언

  • 음성 생성, 립싱크, 영상 편집, 자막 삽입을 한 도구에 몰아넣기보다 elevenlabs·fal.ai·FFmpeg·Descript처럼 기능별 도구로 분리하면 작업 단계를 명확하게 구성할 수 있습니다.
  • 자동 생성 영상의 마지막 단계에서 자막을 수동으로 점검하고 보정하면 영상 내용에 맞는 후처리가 가능합니다.

섹션별 상세

01
게시자는 Pluribus의 원본 장면에서 군집 의식이 Carol에게 죽은 인간을 먹는 방식을 설명하는 부분을 편집 소재로 삼았습니다. gpt-6 astra로 제작을 진행하면서 음성은 elevenlabs, 립싱크는 fal.ai의 모델을 연결해 영상 속 대사와 인물의 입 움직임을 맞췄습니다. 서로 다른 생성 도구를 기능별로 배치한 구체적인 제작 사례라는 점에서 AI 영상 편집의 구성 방식을 확인할 수 있습니다.
02
편집 단계에서 Astra는 전용 편집 기능 대신 FFmpeg를 직접 사용해 영상 처리를 수행했습니다. 이후 게시자가 Descript에서 자막을 수동으로 추가해 자동 생성 결과에 의존하지 않는 후처리 단계를 거쳤습니다. 음성 생성과 립싱크는 모델에 맡기고 편집 명령 실행과 자막 배치는 별도 단계로 나눈 워크플로가 제시됐습니다.

용어 해설

립싱크 모델(Lip Sync Model)
영상 속 인물의 입 모양과 새로 생성한 음성을 맞추는 모델입니다. 음성의 시간 흐름을 입력으로 받아 얼굴 움직임을 조정하므로 더빙 영상 제작에 활용됩니다.
FFmpeg
영상과 음성을 명령줄에서 변환·편집하는 오픈소스 도구입니다. Astra는 별도의 편집 인터페이스 대신 FFmpeg를 직접 호출해 영상 편집 작업을 처리했습니다.
후처리(Post-process)
주요 생성 과정이 끝난 뒤 결과물에 자막이나 색상 보정 같은 추가 작업을 적용하는 단계입니다. 이 게시물에서는 Descript로 자막을 수동 삽입했습니다.
군집 의식(Hive Mind)
여러 개체가 하나의 통합된 의식이나 지능처럼 행동하는 설정을 가리키는 표현입니다. 원본 장면에서는 군집 의식이 Carol에게 죽은 인간을 먹는 방식을 설명합니다.

언급된 도구

gpt-6 astra중립

영상 제작 과정에서 FFmpeg를 직접 호출해 편집 작업을 처리했습니다.

elevenlabs중립

영상에 사용할 음성을 생성했습니다.

fal.ai중립

인물의 입 모양과 생성 음성을 맞추는 립싱크 모델을 제공했습니다.

FFmpeg중립

Astra가 영상 편집을 직접 수행하는 명령줄 도구로 사용했습니다.

Descript중립

완성된 영상에 자막을 수동으로 추가하는 후처리 도구로 사용했습니다.

AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 09. 05.수집 2026. 09. 05.출처 타입 REDDIT

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.