已經會開口的靜照
@influencer_seo 貼了三支。那是 MiniMax H3 Max Lip Sync 的示範,不是本站生成的。把口型對著聲音看。
主持人、一張靜照、一段聲音
@influencer_seo 發的。一張大頭靜照,靠上傳的音訊開口——是那串貼文裡的語言示範之一。署名 @influencer_seo。不是本站生成的。

換一種語言,同一件事
@influencer_seo 發的第二種語言版本,走同一條 Lip Sync 路:靜照加音訊進去,開口成片出來。署名 @influencer_seo。不是本站生成的。

會開口的畫
@influencer_seo 發的,一張對得上史實的開口畫。靜照就是那幅畫,口型跟著聲音走。署名 @influencer_seo。不是本站生成的。

這個模型公開過的範例
靜照加上提供的音訊進去,開口的成片出來。這些是這個模型的範例庫成片,不是本頁生成器跑出來的。
靜照加音訊,一支成片回來
來自這個模型公開的範例庫。讓靜照動起來,口型跟著提供的聲音走。不是本站生成的。

同一組輸入,再跑一版
來自這個模型公開的範例庫。跟上頭那支同一件事:靜照加音訊,開口成片出來。不是本站生成的。

範例庫第三支
來自這個模型公開的範例庫。用來再看一張被聲音帶著走的靜照,別當成這頁跑出來的結果。不是本站生成的。

你已有聲音,還是要寫台詞?
站上三件事看起來很像,輸入其實不是同一種。音檔已經在手上,就用這頁。還要模型幫你寫出聲音,就離開。
靜照加上你錄好的音訊
MiniMax H3 Max Lip Sync。沒有提示詞。這條路在做對口型:口型跟著你上傳的聲音走。
靜照加上你寫的台詞
首頁生成器上的 MiniMax H3 Max 圖片轉影片。把要說的話寫進提示詞,聲音會跟畫面一起出來。
參考檔加上提示詞
MiniMax H3 Max 參考轉影片。把臉、片段或聲音帶進新場景——提示詞還是得你寫。
怎麼跑 MiniMax H3 Max Lip Sync
- 1
上傳靜照
嘴巴看得到比較有用。成片跟著這張靜照的畫面走。
- 2
上傳音訊
至少五秒。超過大約 15 秒,只取開頭那段。做完的成片,長度就等於那段被取用的音訊。
- 3
選解析度,再生成
480P、768P 或 1080P。480P 夠用來看出口型。要定案的那支,用 768P 或 1080P 收。
片長、畫面、點數
長度跟音訊走,不是去拉秒數。
五秒到大約 15 秒
五秒是下限。大約 15 秒是上限。成片對上你送進去的音訊。
480P、768P 或 1080P
跟本站 MiniMax H3 Max 同一組尺寸。480P 用來看口型;768P 或 1080P 用來定案。
點數跟 MiniMax H3 Max 同一張表
480P 每秒 7 點數,768P 15,1080P 30。五秒 480P 是 35 點數。
付費方案的成片歸你
付費方案含商用。靜照裡的肖像、音訊裡的權利,還是得你自己取得授權。
上傳靜照之前
上傳音訊。它讀的是靜照和你提供的聲音。若要模型自己編出台詞,改走 MiniMax H3 Max 圖片轉影片,把台詞寫進提示詞。
跟你上傳的音訊一樣長,至少五秒。超過大約 15 秒,只取開頭那段。
480P、768P 或 1080P。
跟 MiniMax H3 Max 同一張每秒計價表:480P 7 點數,768P 15,1080P 30。五秒 480P 是 35 點數。
嘴巴看得到才是有用的檢查。畫也可以——示範裡就有一支開口的畫——但嘴要在畫面裡。
不是。那條路是模型自己編出台詞。這條路用你已經有的音訊。
付費方案下生成的成片歸你,也包含商用。肖像跟音訊的權利,還是得你自己清。
其他創作方式
更快的試版、參考檔、或運鏡——輸入都跟「靜照加你的音訊」不是同一件事。
在這裡跑一次 Lip Sync 要多少點數
480P 每秒 7 點數,768P 15,1080P 30——跟 MiniMax H3 Max 同一張表。5 秒 480P 是 35 點數。
限時優惠,現折 30%!
臉跟這段聲音,你都備好了。
把靜照和音訊丟進本頁生成器。口型會對上這段聲音。

