GeekLink
本機桌面應用程式,用於 OCR 字幕擷取、語音轉錄與字幕翻譯
前往官網reference to video 是一套以網頁為基礎的 AI 影片生成工作流程,使用一個或多個來源素材作為創作依據。它不必要求文字提示一次記住臉孔、產品、服裝、動作、鏡頭風格與聲音,而是讓每個參考各自定義新合成鏡頭中的特定部分。來源可包括圖像,用於身分、產品、服裝或風格;影片,用於動態與鏡頭行為;以及音訊,用於人聲、音樂與時序。
出色的成果並非逐格複製來源。它保留能建立連續性的細節,同時允許場景、動作、取景與故事節奏改變。本頁將此工具定位於單元劇創作者、AI 網紅、產品行銷活動、動漫角色、時尚系列、音樂影片與品牌世界。與僅靠提示生成的不同處在於控制:參考在整個鏡頭中持續作用,界定哪些必須保持可辨識、哪些可以改變。
專案始於清晰的身分、產品、服裝或風格圖像。當短片與音訊參考能提供動態、鏡頭、人聲或時序時,再加入這些素材。
提示會告訴模型 @Image1、@Video1 與 @Audio1 各自控制什麼,接著描述動作、場景、鏡頭,以及不得改變的細節。
檢查成果中的臉孔、服裝、產品幾何、角色、動態與音訊時序。本頁建議一次只變更一項指示。
身分參考旨在讓臉孔、髮型、身體比例與獨特特徵在新場景中保持可辨識。
產品參考用於在新鏡頭中保留形狀、顏色、材質、包裝與標籤位置。
一段短片參考可引導手勢、時序、身體動作與表演能量。
參考片段可帶入難以用文字描述的橫搖、環繞、推近或手持運鏡。
來源可將地點、燈光語言、調色盤或視覺世界帶入新合成的鏡頭。
在接受音訊參考的模型上,音訊可引導對白、人聲、音樂、節拍與動作時序。
此合成器可搭配 Seedance 2.0 Mini、2.0 Fast 與 2.5、MiniMax H3,以及 Gemini Omni Flash 1.1。Seedance 2.0 與 MiniMax H3 接受最多九張圖像、三段影片與三個音訊檔;Seedance 2.5 接受最多 30 張圖像、10 段影片與 10 個音訊檔;Omni Flash 1.1 使用七個加權參考槽,其中一段影片佔用兩個槽,且僅允許一段影片。合成器會驗證目前的作用中限制。
一個身分參考旨在讓同一張臉、髮型、服裝與比例在更換地點與鏡頭角度時維持一致。
分開的角色參考加上場景參考,用於在互動過程中保持臉孔、服裝與角色定位各自分明。
一位創作者與一項產品可在不同場景之間移動,例如臥室評測與浴室示範,而不必改變人物或重新設計包裝。
全身參考可讓服裝、材質、顏色與配件在生成的場景中保持固定。
能清楚呈現幾何、品牌、顏色與材質的產品參考可重複使用,同時更換創作者、環境、動作或鏡頭。
本頁列出動漫/原創角色、吉祥物與遊戲角色,以及音樂影片表演者作為連續性工作流程。
它會從一個或多個來源素材生成新影片。圖像可定義人物、產品、服裝、場景或風格;影片可引導動作與鏡頭行為;音訊可引導人聲、音樂與時序。提示會為每個參考指派任務。
乾淨的身分圖像為模型提供穩定依據,掌握臉部結構、髮型、比例與獨特細節。額外參考可定義服裝或另一個角度。當提示只命名角色一次,並避免互相衝突的肖像時,一致性會提升。
image to video 通常是將單張靜態圖做成動畫,並視為開頭畫格。reference to video 則可結合多張圖像、影片與音訊檔,在新合成的鏡頭中持續引導身分、產品、動態、鏡頭、風格或時序。
可以。支援的模型可一起接受圖像、影片與音訊參考。圖像用於身分或外觀,短片用於動態或鏡頭方向,音訊用於對白、人聲、節拍或節奏。
影像銳利、主體大到足以檢視、光線中性且遮擋最少。若是角色,建議使用正面或四分之三視角;若是產品,請包含標籤、形狀、材質,以及一個實用的替代角度。
可以,但每個角色都應有各自的圖像參考與固定名稱。建議將每個動作、服裝與位置對應到正確角色,以減少換臉、服裝錯置與角色混淆。
可以。產品參考應清楚呈現幾何、品牌、顏色與材質,同時在每次生成中更換創作者、環境、動作或鏡頭。應仔細檢查標籤位置與比例。
限制因模型而異。Seedance 2.0 與 MiniMax H3 接受最多九張圖像、三段影片與三個音訊檔;Seedance 2.5 接受最多 30 張圖像、10 段影片與 10 個音訊檔;Omni Flash 1.1 使用七個加權參考槽,其中一段影片佔用兩個槽,且僅允許一段影片。合成器會驗證目前的作用中限制。
當素材互相衝突、主體太小,或提示從未說明素材的作用時,參考經常會被忽略。本頁建議移除多餘檔案、裁切出相關細節、使用明確的 @Image、@Video 或 @Audio 標記,並一次測試一項變更。