Seedream 5.0 API 教學:用 BytePlus ModelArk 建立 AI 生圖、修圖與批次圖片功能
Seedream 5.0 API 支援文字生圖、圖片修改、多圖融合與批次生成;本文整理版本選擇、費用、Python 串接與產品限制。
如果只想在網頁上偶爾生成一張圖片,直接使用現成的 AI 生圖工具通常更省事。但當圖片生成要放進 App、電商後台、廣告製作流程,或需要自動批次產出時,API 才真正有價值。
BytePlus ModelArk 提供的 Seedream 系列,不只支援文字生成圖片,也能讀取一張或多張參考圖,進行局部修改、風格融合與批次生成。新版 Dola Seedream 5.0 Pro 更加入指定位置編輯與圖片分層,讓生成結果比較容易接回既有設計流程。
這篇文章會整理 Seedream 5.0 API 的版本差異、費用、基本串接方式與限制。先講結論:需要大量產圖或連續圖片時,Seedream 5.0 Lite 比較實際;需要精準修改畫面元素或拆出可編輯圖層,才需要用價格較高的 Pro。
BytePlus ModelArk 與 Seedream 5.0 是什麼?
BytePlus ModelArk 是讓開發者透過 API 呼叫生成式 AI 模型的平台。API 可以把模型接進網站、App 或企業內部工具,讓程式自動傳送文字與圖片,再取得生成結果。
Seedream 則是其中的圖片生成模型系列。依照 BytePlus 官方文件,目前可用版本包括 Dola Seedream 5.0 Pro、Seedream 5.0 Lite、Seedream 4.5 與 Seedream 4.0。四個版本都能處理文字生圖、單張圖片修改,以及多張參考圖融合,但進階功能並不相同。
這代表選模型時,不該只看版本數字。真正要先問的是:你需要一次產出多張圖,還是要精準控制某個元素的位置?這個差異會直接影響功能與成本。
Seedream 5.0 Pro、Lite、4.5、4.0 有什麼差別?
以下整理 BytePlus 官方功能表中的主要差異:
| 模型 | 主要特色 | 批次圖片 | 串流輸出 | 可用解析度 | 適合情境 |
|---|---|---|---|---|---|
| Dola Seedream 5.0 Pro | 指定位置編輯、圖片分層、精準控制 | 不支援 | 不支援 | 1K、1.5K、2K | 商品修圖、版面微調、設計素材拆層 |
| Seedream 5.0 Lite | 多圖融合、批次生成、高解析度輸出 | 支援 | 支援 | 2K、3K、4K | 電商圖、社群素材、故事分鏡、大量產圖 |
| Seedream 4.5 | 多圖融合與批次生成 | 支援 | 支援 | 2K、4K | 既有 4.5 工作流程 |
| Seedream 4.0 | 可選 1K,並支援快速 Prompt 優化模式 | 支援 | 支援 | 1K、2K、4K | 成本較低的 MVP 與舊版相容需求 |
Seedream 5.0 Pro:重點是「可控制」,不是大量產圖
BytePlus 官方示範以點位、座標與框選區域控制 Seedream 5.0 Pro 的圖片編輯位置。影片來源:Seedream 5.0 Pro 官方教學。


Dola Seedream 5.0 Pro 可以用座標、框選區域、箭頭或手繪標記,告訴模型要修改的位置。例如把參考圖中的人物移到另一張圖指定範圍,或只在框選區域加入商品,不必完全依賴文字描述模型自行猜測位置。
另一個特殊功能是圖片分層。模型可以把一張圖拆成底圖與最多 16 個獨立圖層,每個圖層會以帶透明背景的 PNG 輸出,並附上位置與堆疊順序。設計師或前端工程師可以再移動、縮放、換色或重新組合元素。
這項能力對廣告版型、活動 Banner 與電商素材比較有價值,因為生成結果不再只是一張「壓平」的圖片。不過 Pro 不支援批次圖片與串流輸出,所以它不是每個專案都該優先選的通用版本。
Seedream 5.0 Lite:更適合一般產品功能與大量內容

Seedream 5.0 Lite 支援文字生成單張或多張圖片,也能把單張、多張參考圖轉成一組相關圖片。官方示例包含四格故事、同一角色的連續動作,以及從品牌 Logo 延伸出包裝、帽子與識別卡等完整視覺素材。
它也支援串流輸出。開啟 stream 後,系統可以在每張圖完成時立即回傳,不必等整批圖片全部生成。對使用者來說,等待時不會只有空白畫面;對產品團隊來說,也比較容易設計逐張顯示與取消任務的互動。
如果要做社群素材產生器、電商商品情境圖或故事分鏡工具,我會先選 Lite。它沒有 Pro 的精準分層功能,但更符合「一次生成多個可選結果」的實際使用方式。
Seedream 5.0 API 可以做什麼?
1. 文字生成圖片
最基本的用法是輸入 Prompt,由模型產生一張圖片。官方建議用自然語言描述「主體、動作、環境」,再補上風格、色彩、光線與構圖。
Prompt 不是越長越好。BytePlus 建議英文提示詞控制在 600 字以內,因為資訊過多可能讓模型只抓住部分重點,反而漏掉指定元素。實務上可以先固定主體與用途,再逐步增加材質、鏡頭與排版要求,通常比一次塞進所有形容詞更容易維護。
2. 單圖修改與多圖融合
圖片生成 API 也接受圖片輸入。單圖修改可以增加或移除元素、改變材質與背景,也能調整顏色、視角或尺寸。
多圖融合則能把不同參考圖的元素組合在一起。例如保留第一張圖的人物,再套用第二張圖的服裝。對電商團隊而言,這比每個商品都重新拍攝完整情境圖更有彈性,但仍需要人工檢查 Logo、手部、文字與商品細節,不能把模型輸出直接當成真實商品照片。
3. 批次生成一組相關圖片
Seedream 5.0 Lite、4.5 與 4.0 可以啟用 sequential_image_generation,從文字、一張圖片或多張圖片產出一組相關作品。
這個功能適合漫畫分鏡、品牌視覺延伸與同一角色的不同動作。它的價值不是單純「一次叫 API 多次」,而是讓模型在同一個任務內維持主題與角色的一致性。批次生成仍會按實際輸出的圖片張數計費,因此介面上最好讓使用者選擇張數,避免固定產出過多圖片。
Seedream 5.0 API 怎麼串接?
第一次接觸 ModelArk,可以先在 API Explorer 測試 Prompt、解析度與浮水印設定,再把同一組參數搬進程式。
若使用 Python,也可以沿用 OpenAI SDK 的呼叫方式。先把 API Key 放進環境變數 ARK_API_KEY,不要直接寫在程式碼或上傳到 Git。
pip install openai
export ARK_API_KEY="你的 API Key"
接著建立 ModelArk Client 並呼叫圖片生成 API:
import os
from openai import OpenAI
client = OpenAI(
base_url="https://ark.ap-southeast.bytepluses.com/api/v3",
api_key=os.environ["ARK_API_KEY"],
)
response = client.images.generate(
model="seedream-5-0-lite-260128",
prompt=(
"為一間台灣咖啡品牌製作 1:1 社群貼文。"
"主體是一杯冰拿鐵,放在木桌上,午後自然光,"
"留出右上角標題空間,寫實商業攝影風格。"
),
size="2K",
output_format="png",
response_format="url",
extra_body={"watermark": False},
)
print(response.data[0].url)
這段程式會回傳圖片下載網址。若部署在歐洲區域,Base URL 要改成 https://ark.eu-west.bytepluses.com/api/v3。Seedream 5.0 Lite 目前同時支援新加坡與歐洲區域,正式選區前仍要考量資料處理位置與既有系統部署地點。
Seedream 圖片 API 費用怎麼算?
Seedream 圖片模型依成功輸出的圖片張數計費。以下為 BytePlus 在 2026 年 8 月 12 日更新的官方價格,幣別為美元:
| 模型 | 圖片輸入費 | 圖片輸出費 |
|---|---|---|
| Dola Seedream 5.0 Pro | 第一張免費,第 2 張起每張 0.003 美元 | 單圖:1.5K 以下每張 0.045 美元;高於 1.5K 每張 0.09 美元 |
| Seedream 5.0 Lite | 免費 | 每張 0.035 美元 |
| Seedream 4.5 | 免費 | 每張 0.04 美元 |
| Seedream 4.0 | 免費 | 每張 0.03 美元 |
Pro 的圖片分層價格較低,1.5K 以下每個輸出圖層為 0.0225 美元,高於 1.5K 為 0.045 美元。但每個圖層分開計費,一張圖若拆出多個圖層,總成本會跟著增加。
以 1,000 張圖片估算,Seedream 5.0 Lite 的純輸出費約為 35 美元,Seedream 4.0 約為 30 美元。這還不包含重試、使用者放棄的結果、儲存空間與內容審核成本。產品規劃時,不能只拿單張價格乘上付費使用者數,還要把每次操作實際生成幾張、失敗重試率與圖片保存時間算進去。
從成本與功能一起看,Lite 每張只比 4.0 多 0.005 美元,卻提供新版能力與 PNG 輸出。新專案若沒有既有相容限制,Lite 通常比 4.0 更值得先做 MVP。
串接前要注意哪些限制?
圖片下載網址只保留 24 小時
API 回傳的圖片 URL 只保留 24 小時,逾期會自動清除。正式產品不能把這個網址直接存進資料庫後長期顯示,後端必須在期限內下載圖片,再轉存到自己的物件儲存服務。
這是最容易被忽略、也最可能讓使用者隔天看不到作品的問題。MVP 至少要做到生成成功後立即保存,並記錄下載失敗與重試狀態。
輸入圖片有格式與大小限制
一般圖片生成支援 JPEG、PNG、WebP、BMP、TIFF、GIF、HEIC 與 HEIF,單張圖片最高 30 MB,長寬比需介於 1:16 到 16:1。Seedream 5.0 Pro 最多可輸入 10 張參考圖;Lite、4.5 與 4.0 最多 14 張。
圖片可以使用公開可存取的 URL,或轉成 Base64 後傳入。若用 URL,應避免短效簽名過早失效;若用 Base64,則要留意請求大小與記憶體使用量。
高解析度不一定是最划算的預設值
Lite 支援 2K、3K 與 4K,但多數手機預覽、社群草稿與 A/B 測試不需要一開始就產 4K。較實際的做法是先用 2K 產生候選圖,使用者選定後才進入高解析度流程。
Pro 比較特殊。官方文件指出 1.5K 與 1K 價格相同,而且 1.5K 品質更好,因此沒有尺寸相容需求時,1.5K 比 1K 更適合當預設值。
生成速度與品質要做取捨
Pro 與 4.0 可以把 Prompt 優化模式設為 fast,以部分畫質換取更快速度。Lite 與 4.5 只支援偏重品質的 standard 模式。
這不是單純的技術參數。若產品是即時試穿或聊天式生圖,等待時間會直接影響完成率;若用途是廣告主視覺,品質通常比快幾秒更重要。介面最好依工作情境提供清楚選項,而不是把模型參數原封不動丟給使用者。
Seedream 5.0 API 值得用嗎?
我的判斷是:如果產品需要批次圖片、多張參考圖或自動化工作流,Seedream 5.0 Lite 值得列入 MVP 測試;若只需要偶爾生一張圖,直接使用現成工具反而更省開發與維護成本。
Dola Seedream 5.0 Pro 的價值更集中。它適合需要指定位置修改、拆出圖層並接回設計工具的團隊,不適合只因為名稱有「Pro」就設成全站預設模型。它的輸出價格較高,也不支援批次圖片與串流輸出。
真正會改變這個判斷的,是生成品質與實際重試率。如果 Lite 在你的商品、人像或中文文字場景需要反覆重生,帳面上的每張 0.035 美元就不能代表真實成本。正式開發前,建議先用 30 至 50 組真實任務做小型驗收,記錄可用率、平均生成張數、等待時間與人工修圖時間,再決定是否擴大串接。
FAQ
Seedream 5.0 API 支援中文 Prompt 嗎?
可以傳入中文 Prompt。Dola Seedream 5.0 Pro 的官方文件另列出 14 種新增的原生文字生成語言。若圖片內需要正確顯示中文品牌字樣,仍應用真實素材測試,重要 Logo 與價格文字則建議在後製階段疊加。
Seedream 5.0 Lite 與 Pro 該選哪個?
需要批次生成、串流回傳或 4K 圖片,優先選 Lite。需要用框選、座標精準修改畫面,或把圖片拆成多個可編輯圖層,再選 Pro。
可以用 OpenAI SDK 呼叫 Seedream 嗎?
可以。把 OpenAI Client 的 base_url 指向 ModelArk,並使用 BytePlus 的 API Key 與 Seedream Model ID,即可沿用 client.images.generate() 的呼叫方式。
生成圖片可以永久使用官方 URL 嗎?
不行。BytePlus 官方說明圖片 URL 只保留 24 小時。應由後端在期限內下載並轉存到自己的儲存服務。
Seedream 5.0 API 適合哪種產品?
它比較適合電商商品圖、社群素材產生器、品牌視覺延伸、故事分鏡、圖片修圖與設計工具。若沒有自動化、批次處理或產品內整合需求,接 API 的開發成本可能高於直接使用現成生圖介面。
結語:先驗證工作流,再決定模型版本
Seedream 5.0 API 的重點,不只是把 Prompt 換成一張圖片,而是讓生成、修改、批次輸出與設計後製變成可自動化的工作流。
對多數新產品,我會先以 Seedream 5.0 Lite 做 MVP,因為它支援批次生成、串流輸出與 2K 至 4K 圖片,價格也容易估算。只有當使用者真的需要精準指定位置或可編輯圖層,再把 Pro 做成進階選項。這樣能用較低的開發成本驗證需求,也不會一開始就把產品綁在最複雜的功能上。