OpenDocRouter 上線:一個介面切換文件 AI,便宜解析與可信資料怎麼取捨?
LlamaIndex 推出 OpenDocRouter,以同一介面切換文件解析模型。本文分析 PDF 轉 Markdown、版面定位、ParseBench 成本口徑、缺頁檢查、快取保存與計費,說明文件 AI 的品質與成本取捨。
把 PDF 交給 AI 之前,文件往往需要先轉成可讀取的文字與結構。不同解析模型對表格、公式與多欄排版的表現各有差異,開發者也得分別處理部署、費率與請求格式。LlamaIndex 在 2026 年 10 月 7 日推出 OpenDocRouter,把多種開放與商用模型放進同一套文件解析介面,讓選擇與比較變得更容易。
這項服務的新聞重點,是降低切換模型與建立文件流程的工作量。文件成本可以因此更容易管理,但輸出是否忠於原稿,仍要由使用者驗證。特別是帳單、合約、考卷或研究資料,少了一個符號就可能改變後續答案。OpenDocRouter 值得關注,也需要用完整的資料流程來理解。
從文件到 Markdown,先把輸入整理成可用資料
依 LlamaIndex 官方發布,OpenDocRouter 接受 PDF、PNG、JPEG,以及這些檔案的網址,再輸出 Markdown。Markdown 是用文字符號表示標題、列表與表格等結構的格式。它讓後續搜尋、引用與文件問答比較容易處理內容,但轉換品質會決定後續系統拿到的是不是正確資訊。
服務將每個模型包成有版本的解析配方,包含提示詞、處理流程與設定。開發者可以透過 API,也就是軟體呼叫功能的固定介面,指定要使用的模型。這讓團隊比較不同模型時,不必每次都重新建立一套資料傳送與回應處理程式,能把更多時間放在結果差異上。
例如,一家小公司要整理供應商報價,可以先用同一批文件比較便宜模型與較大型模型,觀察品項、單位與備註是否完整。若每換一個模型就需要修改整個程式,測試成本會很高。統一介面能降低這種成本,但它也只是讓模型比較更方便,並沒有替使用者決定哪一種輸出最適合業務。
對文件 AI 而言,保持來源關聯同樣重要。解析文字若離開了頁碼與原稿位置,後續問答可能只能給出一段答案,卻無法讓人回到文件檢查。建立資料流程時,應一起保存來源檔案識別、頁碼與解析版本。這樣模型回答金額或條款時,讀者纔有機會直接核對。
同一套介面,讓模型選擇回到實際任務
OpenDocRouter 發布時提供 Claude、Gemini、GPT 系列,以及 MinerU、TeleOCR、PaddleOCR 等解析選項。開放模型與商用前沿模型可以放在同一個流程中比較,選擇範圍因此擴大。不過,模型名稱多並不代表每一種文件都該測試全部選項,團隊可以先按資料類型縮小候選範圍。
一般段落清楚的文件,文字轉換可能就已足夠。多層表頭、跨頁表格或包含公式的資料,則需要檢查結構是否保留。若後續用途是建立搜尋索引,部分排版差異可能可以接受。若用途是自動計算帳單,數字、欄位與單位則必須高度可靠。相同一頁 PDF,在不同工作中的容錯程度可以完全不同。
統一輸出還有一個實際好處,是可以在同一條流程中保留替代方案。便宜模型若某頁失敗,可以針對該頁換另一個模型處理,再由人或規則比較。這是應用設計可以採取的做法,並非服務保證會自動選出最正確的模型。開發者仍要定義何時升級,以及如何判斷升級後的輸出是否真的更好。
模型更新速度很快,解析配方也可能改變。官方文件提供模型版本與價格版本資訊,便於追查同一份文件為何得到不同結果。對需要穩定資料的組織,這些版本紀錄比每次都使用最新模型更重要。更新應以固定文件集比較,確認關鍵欄位沒有退步,再增加處理量。
版面定位,讓文字能回到原稿位置
OpenDocRouter 提供 layout 設定,可在解析結果中加入版面元素與定位框。定位框描述文字或圖像在頁面上的位置,讓系統把一段輸出與原稿對應。官方使用自己的定位處理方式,讓不同模型輸出較一致的元素類別,例如標題、表格、公式與註腳。這有助於減少模型之間的格式差異。
對使用者而言,定位功能可以支持核對流程。看到一筆費用,可以回到帳單相應位置查看單位與註記。看到合約條件,可以確認文字是否來自正文,或只是引用段落。這會讓文件問答更容易驗證,也能讓人工審查把注意力集中在關鍵區域,而不用重新翻整份資料。
定位框存在仍不代表內容完全正確。框可以正確指出表格位置,但模型仍可能把小數點讀錯。文字也可能是正確的,卻被連到另一個相近區塊。品質測試應把文字辨識、閱讀順序與定位分開檢查,才能知道哪個部分造成後續錯誤。官方展示的統一格式,解決的是介面與結構的一部分。
多欄文件特別能顯示這個差異。模型若把左欄第一段接到右欄第三段,文字本身可能都讀對,但內容關係已經改變。文件流程應保留閱讀順序,再測試段落與註腳能否正確對應。這比只統計讀對多少字,更接近文件問答或資料抽取的實際需求。

每千頁成本差很大,要保留測試文件的口徑
官方發布頁使用 ParseBench 比較解析品質與成本,列出不同模型處理一千頁測試文件的估計費用。例如,GPT-6 Luna 為零點八美元,MinerU2.5-Pro 為零點八六美元,Claude Opus 5.5 為四十八點八二美元。這些數字指向成本差異,也有特定測試文件與處理方式,不能直接當成任何一千頁資料的報價。
| 官方發布頁的模型例子 | ParseBench 每千頁成本 |
|---|---|
| GPT-6 Luna | 0.80 美元 |
| MinerU2.5-Pro | 0.86 美元 |
| Gemini 3.8 Flash | 5.91 美元 |
| Claude Opus 5.5 | 48.82 美元 |
上述為官方 2026 年 10 月 7 日表列口徑。服務主要按輸入與輸出 token 計費,token 是模型處理文字的計算單位。相同頁數若文字密度、表格與輸出長度不同,費用也會不同。團隊應用自己的文件量測,再建立預算,尤其不要只以 PDF 頁數推算所有工作。
便宜模型的吸引力很明顯,但人工核對與重做也應計入。假設兩個模型都處理一千頁,其中一個多出數十頁需要人工修正,即使模型帳單較低,總成本仍可能比較高。反過來說,若低成本模型已能穩定處理清楚文件,全部使用較昂貴模型也可能缺乏必要。成本選擇需要配合品質門檻。
官方文件另說明,預付額度從二十五美元起,每次儲值另有百分之五費用。啟用版面定位時,成功產出版面的頁面會增加每百萬 token 零點二美元。這些條件提醒使用者,模型價格表之外還有帳戶與功能費用,試用時應一起閱讀,才能比較實際支出。

請求成功,仍可能只有部分頁面完成
依 OpenDocRouter 文件,同步處理最多五十頁,較大文件採非同步工作,單次上限為五百頁,網址或上傳檔案最高五十 MB。非同步是先建立工作,再定期查詢進度與結果,適合不需要一次連線等到全部完成的文件流程。這些限制影響程式如何安排分批處理。
回應需要檢查整體狀態與每一頁的狀態。官方格式把全部成功、部分成功與全部失敗分開。一個成功回應若只被理解成「文件處理好了」,就可能讓失敗頁面消失在後續資料中。程式應列出缺頁,再決定重試、換模型或人工處理,避免不完整文字被當成完整文件。
這對合約和財務資料特別重要。某頁若有關鍵例外條款,少掉那一頁可能讓後續摘要過度肯定。來源頁數與成功頁數應能對得上,空白頁也應明確區分。文件 AI 的完整性檢查不需要等待模型理解所有業務,先確認每一頁是否被處理,就能防止一類明顯問題。
文件與版面定位還可能有不同結果。官方說明,如果某頁文字解析成功,但版面定位失敗,文字仍會保留。這代表資料流程可以繼續使用文字,但應知道缺少定位資訊。把這兩種狀態分開,有助於產品決定哪些用途仍可以繼續,例如一般搜尋,哪些用途需要補做人工核對。
快取與保存期限,影響重試和資料管理
官方文件讓使用者選擇是否使用快取。未啟用時,同步回應的文字只在當次結果中提供。若連線中斷,重新傳送會被視為新的請求,可能重新計費。啟用快取後,結果以加密方式保存二十四小時,同一文件、模型與設定符合條件時,可以再取得已保存的解析頁面。
非同步工作需要啟用快取,因爲結果不能只靠第一次回應傳回。這對長文件流程有實際好處,也表示組織要確認暫存政策符合自己的資料管理要求。檔案含有個人資料或機密時,除了看保存時間,也要檢查相關處理條件與自己是否有權傳送,不能只因服務提供加密就忽略資料用途。
產品也要安排何時取回結果。二十四小時的窗口若錯過,之後可能只剩工作狀態與費用資訊,文字結果需要重新取得。開發者可以在工作完成後,把所需結果安全保存到自己的系統,並記錄模型版本與費用。這項安排能減少重做,也有助於未來查覈。
快取對版本一致性還有另一個影響。比較模型時,應知道結果是新運算還是既有快取。若解析配方或輸入文件改變,需要確認不會混用不同版本的資料。快取帶來的成本與便利,應該建立在清楚的文件識別與版本紀錄上,纔不會讓同一頁看似得到不同答案而無從解釋。
和 LlamaParse 的差異,決定採用方向
LlamaIndex 在發布說明中,把 OpenDocRouter 定位為快速取得與切換多種模型的平臺。LlamaParse 則是管理式文件平臺,提供解析層級、企業控制、自行部署與其他資料功能。這兩種定位讓使用者有不同選擇:想建立模型比較與路由流程,可以先看 OpenDocRouter;需要整套企業文件管理能力,則應比較完整平臺條件。
團隊可以先挑選具有代表性的文件集,涵蓋清楚掃描、低品質影像、多欄文章、表格與公式,再針對關鍵欄位設定通過標準。測試時保存原稿與各版本輸出,人工覈對重要差異。這樣做出來的選擇依據,會比單一綜合分數更貼近自己的業務。
本文的判斷是,OpenDocRouter 把解析模型的選擇成本降低了,但資料可信度仍來自完整來源、缺頁檢查與關鍵內容驗證。最適合先採用它的使用者,是願意自己定義品質標準,並且需要靈活比較模型的開發者。模型路由越容易,清楚知道哪些文件需要更嚴格處理,就越重要。
常見問題
OpenDocRouter 能直接完成可靠的文件問答嗎?
它主要提供解析與結構資訊。後續搜尋、問答與核對流程需要另行設計。原稿位置與頁面完整性應保留,才能讓使用者查驗答案來源。解析錯誤也應先處理,避免流入後續摘要。
每千頁零點八美元就是我的實際費用嗎?
那是官方 ParseBench 測試口徑。實際費用受文件內容、模型、token 用量與版面功能影響,另有儲值費用條件。應先用自己的代表文件測量,再推估總量。
長文件可以一次同步處理嗎?
同步上限爲五十頁,較大文件需要非同步工作與快取。使用者應定期查詢狀態,取回完整結果,並檢查每頁是否成功。文件也有五百頁與五十 MB 等限制。