Infinite Slop 是什麼?AI 影片快過播放速度,無限直播怎麼運作?
Infinite Slop 讓觀眾決定下一段 AI 影片。本文解析 H3 Max 如何跑得比播放快,以及無限直播的架構、成本與限制。
AI 影片正在跨過一條重要門檻:一段影片還沒播完,下一段就已經生成完成。
2026 年 8 月 29 日,fal 工程師 Rehan Sheikh 把 MiniMax H3 Max 接上 Twitch,做成不斷產生新節目的「跨次元電視」。Pieter Levels 隨後推出 Infinite Slop,讓觀眾在聊天室輸入想看的內容,系統再把需求接到下一段影片,試著延續前面的角色與故事。
Pieter Levels 展示 Infinite Slop 的操作與直播畫面,觀眾可透過聊天室影響後續生成內容。 影片來源:Pieter Levels 官方 X 貼文。
真正值得注意的不是「無限垃圾內容」這個玩笑,而是影片供給第一次可以跑在觀看速度前面。當生成不再是主要等待時間,產品競爭就會轉向敘事、選片、記憶、互動與內容安全。
我的判斷是中性偏多。H3 Max 已經足以讓開發者做出新的互動節目原型,但這還不是零延遲、能長時間維持世界一致性的 AI 電視。現在最值得做的是有主題、有邊界的短時互動節目,不是直接燒錢開一個 24 小時無限頻道。
Infinite Slop 發生了什麼?
這波討論由三個環節串起來。
第一個環節是 MiniMax H3。MiniMax 在 2026 年 7 月 31 日發布這款通用多模態影片模型,能理解文字、圖片、影片與聲音,並輸出最長 15 秒、含原生立體聲的影片。H3 的基礎生成流程先產出 768p,再透過另一個模組重建 2K 版本。

如果你想先了解模型本身,可以延伸閱讀本站的 MiniMax H3 Max 速度、價格與直播限制完整整理;本文把焦點放在 Infinite Slop 如何把模型組成媒體產品。
第二個環節是 fal 的後訓練與推論最佳化。後訓練是模型完成基礎訓練後,再用新的資料與方法調整表現。fal 以開放權重的 H3 為起點做出 H3 Max,並針對自家運算系統調整模型與推論引擎。fal 公布的結果是 5 秒影片可在約 2.4 至 3 秒內生成;相同時間能產出的影片量,約為 MiniMax 官方 H3 服務端點的 35 倍。
第三個環節才是社群看到的直播。Rehan Sheikh 先把 H3 Max 產出的片段接成 Twitch 直播,Pieter Levels 再做出可讓聊天室決定下一段內容的 Infinite Slop。MiniMax 官方帳號也轉發這項實驗,把問題改寫成:「生成速度能不能比 Twitch 播放還快?」
這三件事放在一起看,才是這次現象的全貌:MiniMax 提供可再訓練的基礎模型,fal 把生成速度推過播放門檻,開發者則把速度轉成新的媒體產品。
fal 官方 H3 Max 文字轉影片示範,5.18 秒、1344 × 768,並包含原生音訊。 影片來源:fal 官方產品頁。
H3 Max 真的快 50 倍嗎?先看清楚比較口徑
Pieter Levels 的貼文寫的是 15 秒影片約 9 秒完成,速度比原版快 50 倍。這個展示和「比播放快」的結論一致,但 50 倍不是 fal 正式文章使用的數字。
fal 公布的口徑是 5 秒、768p 影片在 3 秒內完成,相較 MiniMax 官方 H3 服務端點約有 35 倍吞吐量,並平均比品質相近的比較模型快 15 倍。不同影片長度、硬體、併發量、計時方式與服務端點,都可能讓倍數不同。

因此,較可靠的寫法不是「H3 Max 固定快 50 倍」,而是:H3 Max 已能在影片播完前產出下一段 768p 影片。
還有一個常被忽略的細節。fal 的 API 是讓產品以程式送出 Prompt 並取得影片的服務介面,其中顯示的 inference 只計算圖形處理器(GPU)後端實際生成畫面的時間,不一定包含排隊、網路傳輸、Prompt 改寫與檔案處理。balanced 模式的 Prompt 自動擴寫約需 1 秒,quality 模式甚至可能花到約 30 秒。產品能不能做到流暢直播,仍要看完整流程,而不是只看模型跑分。
Infinite Slop 如何把 AI 短片變成直播?
Infinite Slop 不是讓模型一次生成一支無限長影片,而是把固定長度的片段不斷接起來。
從公開頁面與狀態資料可以看到,觀眾送出聊天訊息後,請求會依序經過 checking、queued、seen、generating、ready 與 aired 等狀態。白話來說,就是先檢查內容,再排隊、交給「導演」整理成 Prompt、生成影片,最後送進播放清單。
播放器使用 HLS。HLS 是把直播拆成許多小片段,再用播放清單告訴瀏覽器下一段在哪裡的串流方式。2026 年 8 月 30 日讀取 Infinite Slop 的公開播放清單時,每個片段約為 10.16 秒;同一時間的狀態資料顯示系統保留 1 段緩衝內容,並平行生成 2 段影片。
緩衝就是先準備好一小段內容,避免某次生成稍慢時立刻黑畫面。公開程式也顯示,沒有新片時會穿插 rerun,新的片段完成後再優先播放。
因此,Infinite Slop 的流暢感來自三件事:模型生成速度快過片長、同時產生多段內容,以及用緩衝與重播吸收速度波動。這是根據公開前端與即時狀態做出的系統推論,不是開發者公布的完整後端架構。
這算「即時 AI 影片」嗎?和 world model 有什麼不同?
可以說它比即時更快,但不能把所有「即時」混成同一件事。
| 類型 | 生成方式 | 使用者如何控制 | 適合產品 |
|---|---|---|---|
| H3 Max 無限直播 | 先生成一段完整短片,再接到播放清單 | 輸入內容影響下一段或後續片段 | 互動節目、廣告、故事接龍、直播頻道 |
| World model | 邊互動邊逐步產生未來畫面 | 鍵盤、滑鼠、語音或動作持續改變當前世界 | 遊戲、模擬、機器人訓練、可探索環境 |
| 傳統 AI 影片 | 送出 Prompt 後等待整段完成 | 完成前通常無法修改 | 廣告素材、短片、分鏡與社群內容 |
Google DeepMind 的 Genie 3 早在 2025 年就能以 720p、每秒 20 至 24 幀產生可導航的互動世界。這類 world model 會根據使用者的操作,持續預測並生成世界的下一個狀態。2026 年也有 PixVerse R1、Runway 等即時互動方向。因此,H3 Max 不是第一個能即時產生畫面的 AI 系統。
H3 Max 這次的意義,是高品質、帶聲音的通用短片模型也跨過了播放速度。它讓開發者不必先做完整遊戲世界,就能把一般文字轉影片 API 組成一個看起來持續在線的頻道。這條產品路線更容易做出最小可行產品(MVP),但互動延遲、長期記憶與物理一致性也比真正的 world model 弱。
速度變快,有沒有犧牲畫質?
fal 表示 H3 Max 不只是加速版。團隊在後訓練時加入新資料,持續以整體偏好、Prompt 理解與美感三個面向做人工比較,再把通過品質檢查的模型與推論最佳化保留下來。
不過,fal 的「三項第一」來自自家測試,不能單獨當成業界定論。2026 年 8 月 30 日的 Artificial Analysis 盲測榜單顯示,H3 Max 在「有聲音的圖片轉影片」排名第 1;在「有聲音的文字轉影片」則以分數排名第 3。考慮統計不確定範圍後,它可能落在第 1 至第 4 名。這代表 H3 Max 已經在第一梯隊,卻不能簡化成每一種影片任務都穩定第一。
H3 Max 也用解析度換取速度。fal 目前提供 480p 與 768p,不是原始 H3 的 2K 工作流程。對手機直播、社群短片與概念驗證來說,768p 已經可用;要做大型螢幕廣告、後期裁切或細節要求高的正式影片,解析度與重建流程仍要另外評估。
Infinite Slop 的復古電視風格也很聰明。老式錄影帶(VHS)雜訊、快速切換、荒謬節目與「跨次元頻道」本來就容許角色變形、文字錯誤與場景跳動。這不是模型突然解決了所有一致性問題,而是產品選了一種能容納模型缺點的內容形式。
無限 AI 直播要花多少錢?
速度跨過門檻,不代表經濟性也同時成立。
截至 2026 年 8 月 30 日,fal 的 H3 Max 768p 促銷價是每秒 0.04 美元,促銷在 2026 年 9 月 1 日結束後為每秒 0.08 美元。若頻道每一秒都使用新生成畫面,而且每次都一次成功,成本大致如下:
| 768p 影片用量 | 促銷價 | 2026 年 9 月 1 日後牌價 |
|---|---|---|
| 5 秒 | 0.20 美元 | 0.40 美元 |
| 15 秒 | 0.60 美元 | 1.20 美元 |
| 連續 1 小時 | 144 美元 | 288 美元 |
| 連續 24 小時 | 3,456 美元 | 6,912 美元 |

這還沒算重抽、生成失敗、Prompt 處理、內容審查、儲存、傳輸與直播平台成本。Pieter Levels 也直接表示 Infinite Slop 運行費用很高,目前由 fal 贊助。
這個數字對產品決策很重要。無限直播可以當展示,但若沒有贊助、廣告、訂閱或品牌預算,很難只靠「一直生成」形成健康商業模式。更實際的做法是保留熱門片段、穿插重播,只在觀眾真的互動時生成新內容。
這項技術真正會改變哪些產品?
我認為最值得測試的不是一個沒有主題的無限頻道,而是四種有清楚用途的產品。
1. 觀眾共同創作的直播節目
聊天室投票決定角色、地點與下一個事件,系統再把最高票選項做成下一幕。自由輸入雖然更有驚喜,投票與選項更容易控制內容安全、品牌調性與故事連貫。
2. 即時個人化廣告
同一個商品可以依地區、時間、天氣或活動產生不同版本。這類應用的商業價值比無限節目清楚,但 Logo、產品外觀、法規文字與價格不能交給模型自由發揮,仍需鎖定素材與人工審核。
3. 互動式教學與情境演練
語言學習、客服訓練與銷售演練可以依使用者回答產生下一個情境。這不需要每一幀都能操控,只要下一段能在前一段播完前準備好,就能維持對話節奏。
4. 影片企劃的快速預覽
創作者可以在觀看上一版時,同步生成下一個鏡位或替代版本。這會縮短從想法到可比較畫面的時間,但正式成片仍需要選片、剪輯、聲音與權利檢查。
這四個方向的共同點,是生成服務某個決策,不是把「內容很多」本身當成價值。
現在做產品,最容易踩到哪些問題?
故事會延續,不代表細節能長期一致
Infinite Slop 會要求下一段連接前一段,但固定角色的臉、服裝、物件位置與因果關係仍可能漂移。真正的長篇節目需要保存角色設定、前情摘要、關鍵畫面與不可更動的規則,不能只把上一句 Prompt 接到下一句。
生成快,不等於使用者感覺零延遲
聊天室輸入還要經過檢查、排隊、導演整理、Prompt expansion、模型生成、上傳與播放。使用者控制的是「下一段」,不是正在播放的每一幀。產品介面應顯示排隊與生成狀態,讓等待有清楚回饋。
低延遲讓內容安全更困難
速度越快,人工逐段審片的時間越少。fal API 預設開啟自動安全檢查,Infinite Slop 也先檢查聊天訊息,但 Prompt 安全不代表成片一定安全。公開產品還需要輸出檢查、檢舉、停播、黑名單與事件紀錄。
可生成,不代表可以使用所有人物與作品
觀眾很容易要求模型模仿知名卡通、真人、品牌或新聞事件。直播平台、網站與商業發布都要處理著作權、商標、肖像與誤導問題。H3 原始模型開放權重,也不代表任何輸入、輸出或 H3 Max 服務都自動沒有權利限制。
如果要做 MVP,我會怎麼縮小範圍?
最實際的第一版不是 24 小時直播,而是一場 10 分鐘、有固定主題的互動節目。
我會先把範圍限制成:
- 只有一種視覺風格與 2 個固定角色。
- 每段 5 至 10 秒,預先保留至少 1 段緩衝。
- 觀眾先用投票選擇,不開放完全自由的文字輸入。
- 每一段保留角色表、前情摘要與最後一幀,作為下一段條件。
- 設定總生成預算、最大重試次數與立即停播按鈕。
- 驗收內容連貫率、端到端延遲、每分鐘成本與被拒絕的 Prompt 比例。
這個 MVP 足以回答最重要的問題:觀眾是真的想參與故事,還是只覺得第一次看到很新奇?若互動與留存沒有提高,就沒有理由直接擴成無限頻道。
結論:生成不再稀缺,導演能力開始變重要
H3 Max 的突破不是證明 AI 已能穩定拍出無限長電影,而是讓短片生成第一次能在播放之前持續補貨。Infinite Slop 用平行生成、緩衝、重播與聊天室,把這個速度門檻轉成了一個真正可玩的媒體產品。
當影片供給接近無限,稀缺的東西就變成觀眾願意看的方向、角色能否被記住、下一幕是否合理,以及平台能不能在出事前阻止內容上線。
因此,我對這項技術中性偏多,但對「無限內容就是新商業模式」保持保留。現在值得投資的是有邊界的互動節目與生產工具。若後續能在合理成本下維持 30 分鐘以上的角色與世界一致性,並把完整端到端延遲穩定壓在片長內,這個判斷才會進一步轉為偏多。
FAQ
MiniMax H3 Max 是什麼?
H3 Max 是 fal 以 MiniMax H3 為基礎做後訓練,並與自家推論系統共同最佳化的影片模型版本。它支援文字轉影片與圖片轉影片,重點是 480p、768p 的高吞吐量與快速生成。MiniMax H3 原始權重已公開,但 fal 的 H3 Max 發布頁目前提供的是 Playground 與 API,不能直接推論 H3 Max 權重也已公開。
H3 Max 真的可以即時生成影片嗎?
它能在約 3 秒生成 5 秒影片,因此可以比播放速度更快。不過它是先完成一段短片,再把片段接上直播,不是讓使用者即時操控正在播放的每一幀。
Infinite Slop 會記住前面的故事嗎?
系統會嘗試把新需求連接到前一段內容,但這不等於具備穩定的長期記憶。角色外觀、場景與事件因果仍可能漂移;真正長篇內容還需要外部記憶、角色設定與畫面參考。
24 小時 AI 直播大約要多少錢?
以 H3 Max 768p 每秒 0.08 美元的牌價計算,只算一次成功的影片生成約為每天 6,912 美元。促銷期間約為每天 3,456 美元,實際成本還會受到重試、儲存、傳輸與其他服務影響。
H3 Max 和 Genie 3 是同一類產品嗎?
不是。H3 Max 適合快速產生完整短片,再組成直播或內容流程;Genie 3 這類 world model 則針對可持續操控的環境,讓使用者的動作即時改變後續畫面。
可以直接把社群上的示範影片放進商業文章嗎?
能播放或下載,不代表已取得商業重製權。較安全的做法是連回或嵌入原始貼文;若要下載後重新上傳、剪輯或當封面,應先取得權利人同意並確認平台條款。
資料來源
- Pieter Levels:Infinite Slop 發布貼文
- Pieter Levels:15 秒影片約 9 秒與 50 倍速度說法
- MiniMax 官方:對 H3 Max 串流展示的回應
- Rehan Sheikh:H3 Max Twitch 串流展示
- Infinite Slop
- fal:Introducing H3 Max by fal
- fal:H3 Max Text to Video API
- fal:H3 Max Image to Video
- MiniMax:MiniMax H3 open-source announcement
- Artificial Analysis:Text to Video Leaderboard
- Artificial Analysis:Image to Video Leaderboard
- Artificial Analysis:Video Generation Benchmarking Methodology
- Google DeepMind:Genie 3
- PixVerse:R1 real-time world model
- Runway:How Real-Time Video Generation Is Changing Online Interaction