Claude Haiku 5.5 vs DeepSeek V4.1 Flash:真實 Agent 流程實測,便宜 3 倍、快 2.6 倍
朱喬一
創辦人 / CEO
2026年10月8日
6 分鐘讀完

先講結論: 在 Motionflare 的影片生成 Agent 上,Claude Haiku 5.5 比 DeepSeek V4.1 Flash 便宜約 3 倍、快 2.6 倍,成品品質相當。2026 年 10 月 8 日我們用 8 個真實專案做了測試,Haiku 5.5 平均每支影片 $0.046、4.6 分鐘;DeepSeek V4.1 Flash 平均 $0.142(以離峰價計)、11.8 分鐘。8 個專案裡,Haiku 每一個都比較便宜。
出乎意料的是省錢的來源。以 token 單價來看,兩個模型差不多貴。Haiku 5.5 贏在同樣的工作,它只用 三分之一的輸出 token 就完成了。
同一個網站、同一段提示詞、同一條流程。左邊是 DeepSeek V4.1 Flash,右邊是 Claude Haiku 5.5。
為什麼要做這次測試
從 9 月開始,Motionflare 影片背後的預設模型一直是 DeepSeek V4.1 Flash。選它只有一個理由:在能穩定做出可交付影片的模型中,它最便宜(詳見 更新日誌 06)。
2026 年 10 月 7 日,Anthropic 推出 Claude Haiku 5.5,定位是旗下最便宜、最快的小模型。但一張按 token 計價的價目表,說明不了模型在真實工作上到底要花多少錢,所以我們拿真實專案讓兩個模型各跑一次。
測試方法
Motionflare 能把一個網站或一段文字簡介做成一支短動畫影片。每支影片由一個多步驟的 Agent 產生,每一步都是一次 LLM 呼叫:
- 規劃: 讀取素材,逐段規劃影片。
- 分段: 為每一段撰寫動畫程式碼。
- 審查: 由審查環節檢查算繪結果。
- 修正: 修掉審查指出的問題。
我們從正式環境挑了 8 個真實使用者做過的專案,在開發環境中用完全相同的輸入,兩個模型各跑一次。其餘條件全部固定:同樣的程式碼、同樣的提示詞、同樣的設定。8 個輸入裡有 5 個網站、3 段文字簡介(英文、西班牙文和阿拉伯文),每個都產生一支 10 到 15 秒的影片。
成本指整支影片的 LLM 費用,依各家回報的 token 數和各家公開價格計算。時間指從開始到影片完成的實際耗時。
測試結果
每支影片平均值
| DeepSeek V4.1 Flash | Claude Haiku 5.5 | 差距 | |
|---|---|---|---|
| LLM 成本(離峰) | $0.142 | $0.046 | 便宜 3.1× |
| LLM 成本(DeepSeek 尖峰時段) | $0.283 | $0.046 | 便宜 6.2× |
| 生成時間 | 11.8 分鐘 | 4.6 分鐘 | 快 2.6× |
| 輸出 token | 229k | 75k | 少 3.1× |
逐一專案
| 專案 | DeepSeek 成本 | Haiku 成本 | 便宜倍數 | DeepSeek 時間 | Haiku 時間 |
|---|---|---|---|---|---|
| 網站 1 | $0.115 | $0.047 | 2.4× | 9.6 分鐘 | 5.1 分鐘 |
| 網站 2 | $0.126 | $0.049 | 2.6× | 12.8 分鐘 | 4.9 分鐘 |
| 簡介(阿拉伯文) | $0.120 | $0.037 | 3.3× | 10.3 分鐘 | 3.5 分鐘 |
| 簡介(西班牙文) | $0.202 | $0.051 | 4.0× | 13.2 分鐘 | 4.8 分鐘 |
| 網站 3 | $0.150 | $0.044 | 3.4× | 12.0 分鐘 | 4.1 分鐘 |
| 簡介(英文) | $0.196 | $0.050 | 3.9× | 15.8 分鐘 | 5.8 分鐘 |
| 網站 4(荷蘭文) | $0.065 | $0.032 | 2.0× | 7.1 分鐘 | 3.3 分鐘 |
| 網站 5(即上方影片) | $0.159 | $0.056 | 2.9× | 13.6 分鐘 | 5.1 分鐘 |
表中 DeepSeek 的成本皆以離峰價計算。Haiku 5.5 在每個專案上都比較便宜,幅度介於 2.0× 到 4.0×;也在每個專案上都比較快,幅度介於 1.9× 到 2.9×。
Haiku 5.5 為什麼比較便宜:省在 token,不在單價
先看兩家公開的每百萬 token 價格:
| 每 1M token | DeepSeek V4.1 Flash(離峰) | DeepSeek V4.1 Flash(尖峰) | Claude Haiku 5.5 |
|---|---|---|---|
| 輸入 | $0.15 | $0.30 | $0.10 |
| 快取輸入 | $0.003 | $0.006 | $0.01 |
| 輸出 | $0.60 | $1.20 | $0.50 |
以離峰價來看,Haiku 5.5 的單價只便宜一點點,DeepSeek 的快取輸入甚至更便宜。光看價目表,兩者算是打平。
放到真實工作上就不是這樣了。寫程式的 Agent,大部分帳單都花在輸出 token 上,而 DeepSeek V4.1 Flash 每支影片寫了 229k 輸出 token,Haiku 5.5 只寫了 75k。同樣的工作,寫的量只有三分之一。token 少,也正是 Haiku 完成得更快的原因。
給正在替 Agent 挑模型的人一個結論:要比的是每個完成任務的成本,不是每個 token 的成本。 一個話少、直奔答案的模型,完全可能打敗標價更低的模型。
關於 DeepSeek 的尖峰定價
DeepSeek 依時段計費。平日 UTC 01:00 到 04:00、06:00 到 10:00,價格加倍。這次測試剛好落在尖峰時段,原始帳單上 DeepSeek 每支影片 $0.283,是 Haiku 的 6.2×。
拿這個數字當標題並不公平。我們大部分正式環境的流量都落在離峰,所以除非特別註明,本文所有比較都以 DeepSeek 離峰價計算。如果你的工作跑在亞洲上班時間或歐洲上午,實際差距會更接近 6 倍。
限制
- 8 個專案,每個只跑一次。 生成結果本身不固定,換一組輸入,平均值可能會變。
- 品質是我們的主觀判斷,不是基準測試分數。 每一組成品我們都看過,認為品質相當。上方那支影片就是其中一組,未經剪輯,你可以自己判斷。
- 只涵蓋一類工作。 這是一個寫動畫程式碼的 Agent。如果工作的輸出本身就很長、無法縮短,差距可能會小一些。
- 推理強度。 這次測試中,Haiku 5.5 撰寫分段時用的是低推理強度。我們的正式環境設定之後已經調整,換成其他推理強度,結果可能不同。
我們做了哪些調整
Claude Haiku 5.5 現在是 Motionflare 新影片的預設模型。DeepSeek V4.1 Flash 仍然可以在模型選擇器中選用。兩者都是每個場景 1 倍點數,所以這次切換讓使用者更快拿到影片,我們的營運成本也更低。
想試試的話,可以到 motionflare.ai 把任何網站做成一支影片。
常見問題
Claude Haiku 5.5 比 DeepSeek V4.1 Flash 便宜嗎?
以 token 單價來看只便宜一點:Haiku 5.5 每百萬 token 輸入 $0.10、輸出 $0.50,DeepSeek V4.1 Flash 離峰是 $0.15 和 $0.60。以完成一個任務來算就便宜很多:在我們 8 個專案的測試中,Haiku 5.5 每支影片 $0.046,DeepSeek 是 $0.142,便宜約 3 倍,原因是它的輸出 token 只有對方的三分之一左右。
Claude Haiku 5.5 比 DeepSeek V4.1 Flash 快多少?
在我們的測試中,Haiku 5.5 平均 4.6 分鐘完成一支影片,DeepSeek V4.1 Flash 要 11.8 分鐘,快 2.6 倍,而且 8 個專案全部比較快。
兩個模型的輸出品質一樣嗎?
從我們的審查來看,是的:兩個模型做出來的影片品質相當。
做 AI Agent 該選哪個模型?
在你自己的工作上實測每個完成任務的成本。就我們這個寫程式的 Agent 而言,截至 2026 年 10 月,Claude Haiku 5.5 在成本和速度上都勝過 DeepSeek V4.1 Flash。