Creatify Boreal-H3 專攻廣告影片:商品、人物與指令碼一致,比畫面漂亮更難
Creatify 發布以 MiniMax H3 為基礎的 Boreal-H3,針對廣告做後續訓練。本文解讀官方品質數字、回饋迴圈,以及品牌可以如何驗收生成影片。
生成一段漂亮的影片,和交出一支能投放的廣告,中間還有很長一段距離。商品標籤可能被改寫,演員在第二個鏡頭換了長相,指令碼要求的動作也可能沒有出現。Creatify Labs 發布 Boreal-H3,選擇從這些廣告製作的實際問題切入,在 MiniMax H3 基礎上做針對性的後續訓練。
官方發布最有價值的訊息,是把品質拆成參考內容一致、指令碼完成、人物一致與可見瑕疵,而不是只用「更逼真」形容結果。這些指標也讓品牌知道應該檢查什麼。不過,數字來自發布方的內部評估,還不能當成廣告點選率、訂單轉換或所有商品都能成功的保證。
影片模型為何需要懂廣告的限制
一般創作可以容許角色變形或產品造型重新想像,廣告卻經常需要固定細節。一瓶飲料的容量、瓶蓋顏色、品牌字樣與包裝比例,都可能是辨識商品的重要資訊。若影片讓商品看起來更高階,卻展示了根本不存在的版本,素材再漂亮也需要退回修改。
人物也有類似要求。品牌可能希望同一位演員連續出現在開箱、使用與推薦三個鏡頭中。如果第二個鏡頭的臉、服裝或髮型改變,觀眾就會感到接續不自然。廣告生成的難度因此不只是單張畫面品質,而是把多個必須固定的條件跨時間維持住。
Boreal-H3 的定位,就是讓模型更接近這種有約束的工作。它仍然依賴基礎模型提供的影片能力,後續訓練則把注意力放在廣告容易失敗的地方。這不代表每一個品牌都能直接使用同一套設定,而是給了團隊一組比較貼近交付要求的起點。

官方公布的數字,實際測量了哪些事
Creatify 在官方 X 公布參考一致性為百分之八十五點三。指令碼成功率由百分之二十八提高到百分之五十。人物身份匹配由百分之八十三提高到百分之九十四。每段影片的可見瑕疵減少百分之七十。生成時間與估算成本下降百分之二十。這些都是官方對其評估結果的描述。
閱讀時應保留測試範圍。發布方說參考一致性在自己評估的前沿影片模型中最高,並不等於已完成所有市場模型、所有版本與所有素材的獨立比較。指令碼成功率提高,也只表示測試中的完成情況改善,不能直接推出一支廣告能帶來多少營收。
其中指令碼成功率仍為百分之五十,反而提醒了重要的營運問題:即使品質提高,仍可能有相當比例的結果需要返工或重生。品牌採購時應把候選素材、人工挑選、修正與最終合格影片一起計算,才不會把一次生成的價格誤認為整支廣告的成本。
後續訓練,是把失敗轉成下一輪改進
官方介紹的核心是閉環系統,也就是把生成結果送回評估,再決定下一輪改進的方向。它使用經人工校準的評估來診斷失敗,接著可能補充針對性資料、調整強化學習,或改善推論流程。推論指模型收到輸入後產生結果的階段。
這種方式的意義在於,失敗不只被記成一個總分。假設商品標籤容易變形,團隊可以增加與標籤相關的資料與評估。假設人物在不同角度容易漂移,則需要調查身份一致的問題。不同錯誤需要不同幹預,不能期待增加一個泛用提示就全部解決。
官方也提到,當回饋本身不可靠時,會修改評估器或獎勵設計,而不只修改生成模型。這是一個值得借鏡的工作原則。若評分系統把模糊畫面當成高品質,模型可能朝錯誤方向改善。能看出評分是否失真,和能提高分數一樣重要。
Boreal H3 官方發布與示範影片。此為官方展示,並非本文實測結果。 影片來源:Creatify Labs 官方發布素材。
共享實驗記憶,不能直接理解成無人自主進化
Creatify 描述每次實驗會進入共享記憶,影響後續訓練決策。這有助於讓團隊避免重複相同錯誤,也讓資料、評估與模型修改之間有連續性。讀者可以把它理解成一個累積經驗的研發流程,會記住哪些方向有效、哪些方向無效。
但發布文字中的遞迴改進,不足以證明整個系統已經不需要人類設定目標、監督資料或決定發布。官方仍把這次推出稱為一個階段成果。若把這項訊息寫成模型已能完全自行創造下一代模型,就超過了目前公告所能支援的範圍。
對廣告團隊來說,更容易採用的是類似的回饋紀錄方法。把每次退件原因分類,記錄商品、鏡頭、提示版本與修改結果,下一次就能避開已知弱點。即使沒有訓練自己的模型,工作流程也可以因此變得更穩定。
先建立一張商品必須保持的清單
以下是品牌試用設計範例。假設要製作一支保溫杯廣告,第一步不是描述電影感,而是列出必須保持的內容:杯身比例、杯蓋結構、提把形狀、標誌位置與指定顏色。這些專案應附上清楚的參考照片,讓審查人員使用同一套標準。
接著把「可以創作」與「不能改動」分開。桌面材質、背景植物與燈光可以提供多個版本。商品容量標示與外觀則保持固定。若希望出現倒水畫面,還要指定水流與杯口的關係,避免影片看起來熱鬧,卻無法交代產品怎麼使用。
最後定義退件條件。標誌錯字、杯蓋多出零件、杯身變形,都可以直接退回,不必再花時間評價美感。先擋掉明確不能使用的結果,才能把人工審查集中在節奏、情緒與說服力,降低團隊反覆爭論的成本。
多鏡頭素材,應逐段檢查再接起來看
單個鏡頭合格,不表示接在一起也合格。開場的杯子可能是深綠色,第二段在暖光下變成黑色,第三段又出現不同的提把。審查時應先逐段核對必要細節,再連續播放,觀察商品與人物的接續感。
可以為每個鏡頭保留一個固定比較畫面,例如商品第一次完整入鏡的位置。審查人員在同樣位置比較,會比憑印象回想更可靠。對快速運動的鏡頭,也應放慢播放檢視手部、接觸點、文字與物體邊緣,因為正常速度可能掩蓋短暫錯誤。
人物一致則要同時看臉、髮型、服裝與動作。兩張臉相近,並不代表觀眾一定會把它們當成同一個人。若故事依賴同一位演員完成多個動作,這些條件都應列入驗收,而不是只接受模型提供的一個身份匹配數字。
一次生成價格,和可用素材成本不同
假設製作十支合格短片,每支都需要多個候選版本。費用應包含生成的總秒數、挑選時間、後製、字幕與品牌審查。這是成本規劃範例,並不是 Boreal-H3 的正式報價或實測成功率。服務中的實際價格仍要依帳號、方案與生成設定確認。
如果模型讓瑕疵更少,團隊可能減少重生次數。如果身份一致更好,可能減少手動修補。如果生成更快,則可能縮短等待。但這些改善不一定同時反映在每個專案上。有些商品本來就容易生成,新的模型優勢可能較小。細字與特殊形狀商品則可能仍需要大量人工處理。
採購時可以先選三種不同難度的產品,使用同樣的指令碼與審查規則比較。記錄每種產品的合格數量、人工時間與實際帳單,再計算平均交付成本。這會比直接把官方估算成本下降百分之二十套到自己的預算更接近現實。
投放成效,需要另一組實驗
廣告素材透過品質驗收後,仍要看它是否能說清產品價值。影片可能沒有任何瑕疵,卻把主要賣點放得太晚,或讓觀眾不知道下一步該做什麼。模型品質與行銷效果會互相影響,但兩者不是同一項指標。
若要測試投放,可以固定受眾、預算與版位,只比較一個明確差異,例如開場先呈現使用情境,或先呈現商品特寫。不要同時改演員、文案、音樂與優惠,再把結果全部歸功於模型。將品質實驗與投放實驗分開,會更容易知道下一輪該改哪裡。
這也能避免把熱門示範片的觀看數誤認為商業效果。X 上的觀看可能來自技術好奇、轉傳與重播,和目標客戶的購買意願不同。官方示範適合用來理解方向,品牌仍需要自己的受眾資料回答是否值得持續投入。
給製作團隊的交接,應保留版本與退件理由
生成影片經過剪輯、調色與字幕後,常常很難回頭辨認哪一段來自哪次生成。可以把商品參考圖、提示版本、生成設定與最終片段儲存在同一份製作紀錄中。這樣當品牌發現某個標誌錯誤,就能精確找到來源,而不是重新檢查所有候選影片。
退件也應描述可觀察的問題。例如「第四秒杯蓋突然變成兩層」比「看起來不真實」更容易修正。若同一錯誤出現多次,下一輪可改鏡頭、減少轉動或換更清楚的參考圖。把失敗變成可用的資料,正好呼應了官方強調的回饋迴圈。
Boreal-H3 的發布提供了一個清楚方向:廣告影片生成正在從視覺吸引力,走向可交付的一致性。對品牌而言,最值得跟進的是建立自己的驗收標準與成本紀錄。只有知道什麼算可用,才能判斷新模型的改善是否真的轉成更有效率的製作。
從創意提案到交付,誰負責最後一關
品牌視窗、製片與投放人員,對可用的定義可能不同。製片會先看鏡頭是否接得起來,品牌視窗要確認產品與文案,投放人員則要確認尺寸、字幕與行動引導。若只由一位人員根據美感挑片,其他要求可能到最後一天才浮現,造成大量重做。
小型團隊可以先安排一次共同審查,讓所有角色用同一支候選片說明退件原因。討論後把要求整理成兩層:商品與文案錯誤屬於必須修正,節奏與風格則可以比較選擇。這樣就不會因為一位同事偏好某種色調,把本來可用的素材判定成模型失敗。
若是代理商交給客戶,也可以附上影片清單與商品核對紀錄,說明哪些片段經人工確認,哪些仍屬創意候選。客戶看到的是完成品,製作團隊保留的是形成完成品的依據。這會讓後續加拍、改版與新產品沿用流程時更容易。
素材也不必每次全部重新生成。經過核對的商品特寫,可以在不同文案版本中重複使用。需要重新測試的可能只是開場與結尾。把可重用片段和需要重新審查的片段區分,能把品質改善轉成實際製作效率,而不是只增加更多影片檔案。
對這類專攻廣告的模型,最合理的期待是減少特定錯誤,讓人能把時間花在更高價值的創意與驗收。當團隊仍清楚知道誰決定商品真實性、誰決定投放條件,模型的新能力才容易接進現有工作。