GeekLink
로컬에서 자막 OCR 추출, 음성 전사 및 자막 번역을 처리하는 데스크톱 앱
공식 사이트 방문reference to video는 하나 이상의 소스 자산을 창의적 근거로 사용하는 웹 기반 AI 비디오 생성 워크플로우입니다. 텍스트 프롬프트에 얼굴, 제품, 의상, 움직임, 카메라 스타일, 사운드를 한 번에 기억하도록 요청하는 대신, 각 레퍼런스가 새로 구성된 샷의 특정 부분을 정의합니다. 소스에는 정체성, 제품, 의상, 스타일을 위한 이미지, 움직임과 카메라 동작을 위한 동영상, 음성, 음악, 타이밍을 위한 오디오가 포함될 수 있습니다.
좋은 결과는 소스 프레임을 그대로 재현하지 않습니다. 연속성을 만드는 세부 사항은 유지하면서 배경, 동작, 구도, 스토리 비트가 바뀔 수 있도록 합니다. 이 페이지는 이 도구를 에피소드형 크리에이터, AI 인플루언서, 제품 캠페인, 애니메 캐릭터, 패션 시퀀스, 뮤직 비디오, 브랜드 세계관에 적합한 것으로 소개합니다. 프롬프트만 사용하는 생성과의 차이는 제어로 설명됩니다. 레퍼런스는 샷 전체에서 활성 상태를 유지하며, 무엇이 인식 가능하게 남아야 하고 무엇이 바뀔 수 있는지 정의합니다.
프로젝트는 정체성, 제품, 의상, 스타일을 위한 선명한 이미지로 시작합니다. 움직임, 카메라, 음성, 타이밍에 기여할 때 짧은 동영상 및 오디오 레퍼런스를 추가합니다.
프롬프트는 @Image1, @Video1, @Audio1이 무엇을 제어하는지 모델에 알려준 다음, 바뀌지 않아야 할 동작, 배경, 카메라, 세부 사항을 설명합니다.
얼굴, 의상, 제품 형태, 역할, 움직임, 오디오 타이밍에 대해 결과를 검토합니다. 이 페이지는 한 번에 하나의 지시만 변경할 것을 권장합니다.
정체성 레퍼런스는 새로운 장면에서도 얼굴, 머리카락, 신체 비율, 구별되는 특징을 인식 가능하게 유지하는 것을 목표로 합니다.
제품 레퍼런스는 새로운 샷에서 모양, 색상, 재질, 패키징, 라벨 위치를 유지하는 데 사용됩니다.
짧은 동영상 레퍼런스는 제스처, 타이밍, 신체 움직임, 연기 에너지를 안내할 수 있습니다.
레퍼런스 클립은 텍스트로 설명하기 어려운 팬, 오빗, 푸시인, 핸드헬드 무브를 전달할 수 있습니다.
소스는 장소, 조명 언어, 색상 팔레트, 시각적 세계를 새로 구성된 샷으로 가져올 수 있습니다.
오디오 레퍼런스를 허용하는 모델에서 오디오는 대화, 음성, 음악, 비트, 동작 타이밍을 안내할 수 있습니다.
이 컴포저는 Seedance 2.0 Mini, 2.0 Fast, 2.5, MiniMax H3, Gemini Omni Flash 1.1과 함께 작동합니다. Seedance 2.0과 MiniMax H3는 최대 9개의 이미지, 3개의 동영상, 3개의 오디오 파일을 허용합니다. Seedance 2.5는 최대 30개의 이미지, 10개의 동영상, 10개의 오디오 파일을 허용합니다. Omni Flash 1.1은 7개의 가중치 레퍼런스 슬롯을 사용하며, 동영상 하나는 두 개의 슬롯을 사용하고 동영상은 하나만 허용됩니다. 컴포저는 활성 한도를 검증합니다.
하나의 정체성 레퍼런스는 장소와 카메라 앵글이 바뀌어도 동일한 얼굴, 헤어스타일, 의상, 비율을 유지하는 것을 목표로 합니다.
별도의 캐릭터 레퍼런스와 장면 레퍼런스를 사용하여 상호작용 전반에 걸쳐 얼굴, 의상, 역할을 구별되게 유지합니다.
한 명의 크리에이터와 하나의 제품이 침실 리뷰와 욕실 시연 등 장소를 이동해도 인물이 바뀌거나 패키징이 재디자인되지 않습니다.
전신 레퍼런스는 생성된 장면 전반에서 의류, 소재, 색상, 액세서리를 고정할 수 있습니다.
형태, 브랜딩, 색상, 소재를 명확히 보여주는 제품 레퍼런스는 크리에이터, 환경, 동작, 카메라가 바뀌어도 재사용할 수 있습니다.
이 페이지는 애니/OC 캐릭터, 마스코트와 게임 캐릭터, 뮤직 비디오 공연자를 연속성 워크플로우로 나열합니다.
하나 이상의 소스 자산에서 새로운 비디오를 생성합니다. 이미지는 인물, 제품, 의상, 장면, 스타일을 정의할 수 있고, 동영상은 움직임과 카메라 동작을 안내하며, 오디오는 음성, 음악, 타이밍을 안내할 수 있습니다. 프롬프트는 모든 레퍼런스에 역할을 할당합니다.
깨끗한 정체성 이미지는 모델에 얼굴 구조, 머리카락, 비율, 구별되는 세부 사항에 대한 안정적인 근거를 제공합니다. 추가 레퍼런스는 의상이나 다른 각도를 정의할 수 있습니다. 프롬프트에서 캐릭터를 한 번만 명명하고 상충하는 초상화를 피하면 일관성이 향상됩니다.
image to video는 일반적으로 하나의 스틸 이미지를 애니메이션화하고 이를 오프닝 프레임으로 취급합니다. reference to video는 여러 이미지, 동영상, 오디오 파일을 결합하여 새로 구성된 샷 전체에서 정체성, 제품, 움직임, 카메라, 스타일, 타이밍을 계속 안내할 수 있습니다.
예. 지원되는 모델은 이미지, 동영상, 오디오 레퍼런스를 함께 받을 수 있습니다. 이미지는 정체성이나 외형에, 짧은 동영상은 움직임이나 카메라 방향에, 오디오는 대화, 음성, 비트, 페이싱에 사용됩니다.
피사체가 검사할 수 있을 만큼 크고, 조명이 중립적이며, 가림이 최소인 선명한 이미지입니다. 캐릭터의 경우 정면 또는 3/4 뷰를 권장하며, 제품의 경우 라벨, 모양, 소재, 유용한 대체 각도 하나를 포함하세요.
예, 하지만 각 캐릭터는 별도의 이미지 레퍼런스와 안정적인 이름을 가져야 합니다. 모든 동작, 의상, 위치를 올바른 캐릭터에 매핑하여 얼굴 교체, 의상 혼동, 역할 혼란을 줄이는 것이 좋습니다.
예. 제품 레퍼런스는 형태, 브랜딩, 색상, 소재를 명확히 보여주어야 하며, 각 생성에서 크리에이터, 환경, 동작, 카메라가 바뀝니다. 라벨 위치와 비율을 면밀히 검토해야 합니다.
한도는 모델에 따라 다릅니다. Seedance 2.0과 MiniMax H3는 최대 9개의 이미지, 3개의 동영상, 3개의 오디오 파일을 허용하고, Seedance 2.5는 최대 30개의 이미지, 10개의 동영상, 10개의 오디오 파일을 허용합니다. Omni Flash 1.1은 7개의 가중치 레퍼런스 슬롯을 사용하며, 동영상 하나는 두 개의 슬롯을 사용하고 동영상은 하나만 허용됩니다. 컴포저는 활성 한도를 검증합니다.
자산이 충돌하거나, 피사체가 너무 작거나, 프롬프트가 자산의 역할을 설명하지 않을 때 레퍼런스가 무시되는 경우가 많습니다. 이 페이지는 중복 파일을 제거하고, 관련 세부 사항 주위로 자르고, 명시적인 @Image, @Video, @Audio 토큰을 사용하고, 한 번에 하나의 변경만 테스트할 것을 권장합니다.