가입하면 프리미엄 플랜 할인할인 받기

동영상

립싱크

립싱크는 제공한 오디오 트랙에 맞춰 입 모양이 움직이도록 얼굴을 애니메이션하는 기술이에요. 정지된 인물 사진이나 무음 클립을 내 대사를 말하는 사람처럼 보이게 만들어요.

립싱크는 동영상 생성과는 다른 기능이에요. 모델이 오디오 파형을 조건으로 받아 프레임마다 입 모양을 움직여요. 이 기능을 제공하는 도구는 보통 얼굴과 음성 파일을 받아 새 클립을 돌려줘요.

샷 안에서 대사를 생성하는 건 전혀 다른 이야기예요. 이 경우 엔진이 프롬프트와(일부 엔진에서는) 음성 샘플을 바탕으로 연기와 소리를 함께 만들어 내며, 내가 제공한 트랙에 맞추는 과정은 없어요.

eroq에서는

eroq에는 립싱크 도구가 없어요. 사운드를 지원하는 엔진은 클립의 일부로 대사를 렌더링할 수 있지만(Veo 3.1은 대사를 렌더링하고, Seedance와 Hailuo 3에서는 캐릭터의 음성 샘플이 함께 전달돼요), 기존 클립 위에 별도 음성 트랙을 얹어 입 모양을 맞출 수는 없어요. 보이스 스튜디오에서 만든 내레이션은 직접 쓰는 편집 툴에서 영상 아래에 깔아 주세요.

자주 묻는 질문

eroq로 캐릭터가 내 대본을 말하게 할 수 있나요?

입 모양까지 맞추는 건 불가능해요. 보이스 스튜디오에서 대본으로 음성을 만들고 영상은 따로 렌더링한 다음 편집 툴에서 합칠 수는 있지만, 얼굴은 싱크되지 않아요.

Veo 3.1은 대사를 실제로 어떻게 처리하나요?

프롬프트를 바탕으로 목소리를 포함한 대사를 샷의 일부로 생성해요. 목소리를 고를 수도, 오디오를 직접 넣을 수도 없으니, 대본이 있는 내레이션보다는 가볍게 지나가는 대사에 어울려요.

립싱크 기능이 로드맵에 있나요?

로드맵에 대한 약속은 공개하지 않아요. 현재로서는 이를 지원하는 엔드포인트도, 스튜디오 기능도 없어요.