
先講重點
把 GPT Images 2.5 和 H3 Max 當成同一份創作的兩個階段來跑,這就是一套圖片轉影片工作流:
- 用 GPT Images 2.5 把主體、構圖、讀得清楚的字,以及下一鏡必須留下來的細節定下來。
- 下載或匯出這張靜態圖。
- 把靜態圖上傳到 H3 Max,寫動作、運鏡、時間和聲音。
- 拿第一條成片對回來源靜態圖,哪一階段出問題就回哪一階段改。
這是兩個獨立產品介面之間的手動交接,不是直接串接。GPT Images 2.5 給你一張可以放大檢查的靜態圖。在現在的 h3max.ai 介面上,H3 Max 能把提示詞或起始畫面做成一支 5–15 秒、聲音已同步的影片。
整篇用的例子是假設的產品預告:一支虛構的琥珀色瓶子、讀得清楚的標籤,再加上一次短運鏡。提示詞是能重用的寫法,不是宣稱這幾句原文曾被拿去實測、還量過結果。
每個模型只做一件清楚的事
兩個模型都被要求一次解決整份拍攝說明時,這條工作流很容易失控。拆法要看觀眾真正會盯的那一層。
| 階段 | 輸入 | 輸出 | 通過條件 |
|---|---|---|---|
| 靜態畫面設計 | 產品或場景拍攝說明、必要時的參考照片、精確用字 | 一張解析度夠用的靜態圖 | 標籤、主體、版面和參考細節都對 |
| 動態畫面設計 | 已通過的靜態圖、動作與運鏡說明 | 一支 5–15 秒的 H3 Max 成片 | 開場畫面、主體辨識、動作、鏡頭路徑和聲音都對得上 |
| 修改 | 失敗的輸出加上原始拍攝說明 | 新的靜態圖或影片成片 | 只改真正失敗的那一階段 |
這組分工同時給你一條排錯規則。標籤錯了,回到圖像階段。標籤對,可是瓶子漂起來,或鏡頭沒照拍攝說明走,就留著靜態圖,重寫動作說明。交接完主體立刻變了,先檢查來源檔和起始畫面指令,再決定要不要改整個構想。
先寫一份交接說明
兩個生成器都先別開。先寫清楚:靜態圖必須把什麼釘死,成片要補上什麼。一份短交接說明,往往比一則塞滿的提示詞更準。
示例說明:虛構琥珀瓶上市預告
- 最終素材: 一支給落地頁用的短產品預告。
- 靜態圖必須釘死: 一支沒有品牌的琥珀色瓶子,置中放在淺色石材表面,虛構標籤寫著 “NORTH STAR”,邊緣乾淨,四周留夠開場構圖的空間。
- 動態要補上: 慢慢推進、瓶子朝光線輕輕轉一點、背景穩住,再加上克制的玻璃移動聲和室內環境聲。
- 不能改: 瓶身輪廓、標籤用字、置中位置、暖色調。
- 第一輪: 先做一張靜態圖,再用草稿解析度跑一支 5 秒的 H3 Max 成片。
- 先別升級: 主體和動作節奏都過關之前,不要直接去跑更大的成片。
靜態階段回答「畫面上有什麼?」影片階段回答「什麼在變、何時變?」兩個問題拆開,第二則提示詞會比較短,失敗時也比较好對症。
第一步:在 GPT Images 2.5 做出參考靜態圖
images-25.com 上的 GPT Images 2.5 吃文字提示詞或上傳照片,回一張可下載的 1K、2K 或 4K 靜態圖。那個站上,Flare 適合日常起手;同一主體要做超過一輪、而且每輪都要可控時,Sunburst 比較對得上有意識的修改。
虛構瓶子先從能守住重點的最小說明開始:
一張乾淨的棚拍產品靜態圖:一支沒有品牌的琥珀色玻璃瓶,放在淺色石材表面,構圖置中,左側有溫暖窗光,虛構的米色標籤清楚寫著 “NORTH STAR”,瓶子四周留足空間,安靜的高質感上市攝影,不要多加物件,不要多加文字。
手上已經有產品照片的話,上傳它,一次只改一件事。例如:
保留瓶身形狀、標籤用字、瓶蓋和鏡頭角度。把背景換成淺色石材棚拍表面,並從左側加溫暖窗光。不要多加第二支瓶子或新文字。
第一張結果,放大檢查過才算數。看標籤、邊緣、瓶蓋、反光和背景。確認主體夠置中,撐得住接下來的運鏡。靜態圖沒過,就留在這個階段:要換方向用 Flare;要圍著同一主體做針對性的下一輪,用 Sunburst。觀眾必須讀懂的標籤拼錯了,別丟給 H3 Max 修。
解析度照任務選,不要照習慣選。1K 靜態圖適合拿來確認方向;構圖穩了,再另外生成 2K 或 4K,換更大的檔。新解析度要當成一份獨立輸出再看過,才交給影片階段。
第二步:準備手動交接用的檔案
下載已通過的靜態圖,原始拍攝說明放在旁邊。檔案怎麼交,刻意保持單純:
- 用版本檔名存靜態圖,例如
north-star-still-v03。 - 把精確用字和「不能改」清單記在筆記裡。
- 打開 H3 Max 影片生成器,把那張靜態圖上傳成起始畫面。
- 兩階段之間不要偷偷裁切或修圖;來源改了,就把這次改動記下來。
兩個產品不會共用隱藏狀態。除非靜態圖和動作提示詞把該留的部分講清楚,H3 Max 不會知道 GPT Images 2.5 當初被要求守住哪些地方。檔名整齊也不等於兩邊已經串接;這裡的交接,就是檔案從一個介面走到另一個介面。
第三步:在 H3 Max 導出動起來的那一條
在 h3max.ai 上,提示詞或一張起始畫面可以變成 5–15 秒的 MiniMax H3 Max 影片。現在的生成器提供 480P、768P 和 1080P 控制項,回傳的成片帶同步聲音。先跑短草稿,動作好不好判斷起來比較不浪費。
上面那張靜態圖,第一份動作說明可以這樣寫:
5 秒產品預告。琥珀色瓶子維持置中,「NORTH STAR」標籤維持可讀。從提供的靜態圖起手。鏡頭慢慢推向瓶子,同時瓶子朝溫暖窗光輕輕轉一點。淺色石材背景保持穩定。加上安靜的玻璃移動聲和室內環境聲。不要新物件,不要多加字,不要突然晃鏡。
提示詞不必把靜態圖裡每一項視覺事實再講一遍。它要寫的是變化:動作、運鏡、時間和聲音。鏡頭如果必須落到一個已知的最終構圖,而且介面有這個控制項,可以加尾格畫面;落地有沒有守住,要自己核,別預設它一定停在那。
改下一輪時,若當下要測的就是這個控制項,先跑一支短的 480P。動作站得住了,再用交付需要的解析度重跑選中的那一條。更大的輸出,補不了薄弱的運鏡指令。
第四步:把成片跟靜態圖對過
最有用的檢查不是「看起來還不錯」這種籠統感覺,而是照交接順序對:
- 開場畫面: 影片是從提供的構圖起手,還是動作還沒開始,主體就已經挪了?
- 辨識: 瓶身輪廓、瓶蓋、標籤和顏色還認得出來嗎?
- 動作: 是一個清楚的鏡頭或主體動作,還是好幾條指令在搶戲?
- 連戲: 主體在動時,邊緣、反光、手部和背景還站得住嗎?
- 聲音: 同步聲音有沒有對上拍攝說明,而且跟動作一起出現?
- 落地: 有給尾格畫面的話,這一條有沒有乾淨落到它?
用失敗類型決定下一動回哪:
| 失敗內容 | 回到 | 下一步怎麼改 |
|---|---|---|
| 用字、版面或來源主體 | GPT Images 2.5 | 修正靜態圖,或把保留要求寫得更清楚 |
| 主體對,可是動作發虛 | H3 Max | 用一個動作、一條寫明時長的鏡頭路徑 |
| 開場畫面接近,鏡頭卻慢慢跑掉 | H3 Max 和交接筆記 | 重講該留的細節,並拿掉互相搶戲的動作 |
| 靜態圖和成片都說得通,專案說明卻含糊 | 拍攝說明 | 再次生成前,先決定觀眾必須先看見什麼 |
這圈迴路擋得住一種常見浪費:真正的問題是動作提示詞塞太滿,卻回頭重做靜態圖。
公開訊號能證明什麼
名稱要分清楚,因為兩個階段做的事不一樣。
MiniMax 官方 2026 年 7 月 31 日的 H3 發布文介紹了 H3 家族。在 2026 年 8 月 29 日的 X 貼文裡,官方帳號 @MiniMax_AI 說,其開放權重的 H3 由合作方改過,並提到後訓練與推論工作。這支持把 H3 Max 謹慎寫成經過調校或後訓練的 H3 衍生版本。這不能證明 H3 Max 就是同一個模型名稱,也不能證明它是公開的 MiniMax 檢查點,更不能當成每一條成片的保證。
OpenAI 的 2026 年 9 月 8 日公告把給一般使用者的產品叫做 ChatGPT Images 2.5,並把 GPT-Image-2.5 Flare 和 GPT-Image-2.5 Sunburst 列為 API 名稱。官方 @OpenAI X 貼文是發布訊號,不是 OpenAI 產品已接到 H3 Max 的證據。
社群貼文可以幫你找到值得跑的測試。例如 @DesignArena 的 2026 年 8 月 26 日 X 貼文討論了 H3 Max 的品質與速度觀察。把它當成帶日期的社群基準快照,不是你的產品、提示詞、託管方式、解析度或帳號的結果。雙階段工作流還是得在你真正在意的拍攝說明上跑一次。
常見問題
GPT Images 2.5 和 H3 Max 有直接串接嗎?
這裡沒有證據證明存在直接串接。先做或改靜態圖,下載它,再上傳到 H3 Max 並附上動作說明。手動交接講清楚,兩個模型就能一起用,不必宣稱它們共用同一條管線。
進 H3 Max 之前,該用 Flare 還是 Sunburst?
在找第一版構圖,或做日常靜態圖時,用 Flare。同一主體要做超過一輪、而且每輪都是有意識的修改時,用 Sunburst。不論選哪個,上傳前都要檢查靜態圖;影片階段沒辦法把還沒通過的來源自動修對。
H3 Max 就是 MiniMax H3 嗎?
不是。現有公開證據支持把它謹慎寫成「經過調校」或「後訓練的衍生版本」。兩個名稱分開用,並用現在生成器吐回的 H3 Max 成片判斷結果。
交接失敗時該改哪一層?
一次只改一層。用字、版面或主體辨識錯了,就修靜態圖。開場畫面對、可是動作或運鏡錯了,就留著靜態圖,重寫 H3 Max 的動作提示詞。拍攝說明本身含糊,再次生成前先決定需要的第一個和最後一個視覺狀態。
收束
創作任務確實分成兩個時刻時,GPT Images 2.5 和 H3 Max 適合接成一條順序:先做出經得起檢查的靜態圖,再要求動作尊重它。檔案交接講明白,把保留清單放在動作提示詞旁邊,讓每一次檢查告訴你該回哪一階段再跑一輪。
