동영상
이미지 투 비디오(Image-to-Video)
이미지 투 비디오는 정지 이미지를 움직여 동영상 클립으로 만드는 방식이에요. 이미지가 피사체와 구도를 고정하고, 프롬프트는 움직임을 설명해요. 생성 영상에서 특정 얼굴이나 제품을 일관되게 유지하는 표준적인 방법이에요.
레퍼런스 이미지에 인물, 구도, 스타일이 이미 담겨 있으니 프롬프트는 움직임만 지시하면 돼요. 몸을 돌리는 동작, 스치는 바람, 푸시 인처럼요. 일부 엔진은 첫 프레임과 마지막 프레임을 모두 받아 그 사이를 보간하므로, 클립이 어디서 끝날지 정밀하게 제어할 수 있어요.
eroq에서는
Sora 2 Pro를 제외한 모든 동영상 엔진이 시작 이미지를 받고, Seedance, Veo 3.1, Kling, Hailuo 엔진은 마지막 프레임도 받아요. 소스로는 사진이나 이미지 스튜디오에서 만든 렌더를 쓸 수 있어요(‘동영상으로 만들기’를 누르세요). Motion One에서는 저장한 캐릭터의 이미지도 쓸 수 있고, 다른 엔진에서는 캐릭터가 대신 레퍼런스 이미지로 전달돼요.
자주 묻는 질문
이미지 투 비디오로 만들어도 얼굴이 유지되나요?
네, 그게 바로 이 방식의 목적이에요. 특히 Kling과 Seedance는 움직이는 동안에도 인물을 잘 유지해요.
프롬프트에서 이미지를 다시 설명해야 하나요?
아니요, 움직이는 것만 설명하세요. 피사체를 다시 설명하면 레퍼런스와 충돌해요.
이미지 투 비디오가 텍스트 투 비디오보다 비싼가요?
거의 그렇지 않아요. 가격은 시작 이미지가 아니라 엔진, 길이, 해상도에 따라 정해져요. Motion One 클립은 시작 이미지가 있든 없든 60 크레딧이에요. 예외로 Grok Imagine은 프레임 이미지 한 장당 3 크레딧이 추가되고, Hailuo 3에서는 레퍼런스 이미지(캐릭터 이미지 포함) 한 장마다 11 크레딧이 추가돼요.