Claude Haiku 5.5 vs DeepSeek V4.1 Flash:真實 Agent 流程實測,便宜 3 倍、快 2.6 倍

朱喬一

朱喬一

創辦人 / CEO

2026年10月8日

6 分鐘讀完

Claude Haiku 5.5 vs DeepSeek V4.1 Flash:真實 Agent 流程實測,便宜 3 倍、快 2.6 倍

先講結論: 在 Motionflare 的影片生成 Agent 上,Claude Haiku 5.5 比 DeepSeek V4.1 Flash 便宜約 3 倍、快 2.6 倍,成品品質相當。2026 年 10 月 8 日我們用 8 個真實專案做了測試,Haiku 5.5 平均每支影片 $0.046、4.6 分鐘;DeepSeek V4.1 Flash 平均 $0.142(以離峰價計)、11.8 分鐘。8 個專案裡,Haiku 每一個都比較便宜。

出乎意料的是省錢的來源。以 token 單價來看,兩個模型差不多貴。Haiku 5.5 贏在同樣的工作,它只用 三分之一的輸出 token 就完成了。

同一個網站、同一段提示詞、同一條流程。左邊是 DeepSeek V4.1 Flash,右邊是 Claude Haiku 5.5。

為什麼要做這次測試

從 9 月開始,Motionflare 影片背後的預設模型一直是 DeepSeek V4.1 Flash。選它只有一個理由:在能穩定做出可交付影片的模型中,它最便宜(詳見 更新日誌 06)。

2026 年 10 月 7 日,Anthropic 推出 Claude Haiku 5.5,定位是旗下最便宜、最快的小模型。但一張按 token 計價的價目表,說明不了模型在真實工作上到底要花多少錢,所以我們拿真實專案讓兩個模型各跑一次。

測試方法

Motionflare 能把一個網站或一段文字簡介做成一支短動畫影片。每支影片由一個多步驟的 Agent 產生,每一步都是一次 LLM 呼叫:

  1. 規劃: 讀取素材,逐段規劃影片。
  2. 分段: 為每一段撰寫動畫程式碼。
  3. 審查: 由審查環節檢查算繪結果。
  4. 修正: 修掉審查指出的問題。

我們從正式環境挑了 8 個真實使用者做過的專案,在開發環境中用完全相同的輸入,兩個模型各跑一次。其餘條件全部固定:同樣的程式碼、同樣的提示詞、同樣的設定。8 個輸入裡有 5 個網站、3 段文字簡介(英文、西班牙文和阿拉伯文),每個都產生一支 10 到 15 秒的影片。

成本指整支影片的 LLM 費用,依各家回報的 token 數和各家公開價格計算。時間指從開始到影片完成的實際耗時。

測試結果

每支影片平均值

DeepSeek V4.1 FlashClaude Haiku 5.5差距
LLM 成本(離峰)$0.142$0.046便宜 3.1×
LLM 成本(DeepSeek 尖峰時段)$0.283$0.046便宜 6.2×
生成時間11.8 分鐘4.6 分鐘快 2.6×
輸出 token229k75k少 3.1×

逐一專案

專案DeepSeek 成本Haiku 成本便宜倍數DeepSeek 時間Haiku 時間
網站 1$0.115$0.0472.4×9.6 分鐘5.1 分鐘
網站 2$0.126$0.0492.6×12.8 分鐘4.9 分鐘
簡介(阿拉伯文)$0.120$0.0373.3×10.3 分鐘3.5 分鐘
簡介(西班牙文)$0.202$0.0514.0×13.2 分鐘4.8 分鐘
網站 3$0.150$0.0443.4×12.0 分鐘4.1 分鐘
簡介(英文)$0.196$0.0503.9×15.8 分鐘5.8 分鐘
網站 4(荷蘭文)$0.065$0.0322.0×7.1 分鐘3.3 分鐘
網站 5(即上方影片)$0.159$0.0562.9×13.6 分鐘5.1 分鐘

表中 DeepSeek 的成本皆以離峰價計算。Haiku 5.5 在每個專案上都比較便宜,幅度介於 2.0× 到 4.0×;也在每個專案上都比較快,幅度介於 1.9× 到 2.9×。

Haiku 5.5 為什麼比較便宜:省在 token,不在單價

先看兩家公開的每百萬 token 價格:

每 1M tokenDeepSeek V4.1 Flash(離峰)DeepSeek V4.1 Flash(尖峰)Claude Haiku 5.5
輸入$0.15$0.30$0.10
快取輸入$0.003$0.006$0.01
輸出$0.60$1.20$0.50

以離峰價來看,Haiku 5.5 的單價只便宜一點點,DeepSeek 的快取輸入甚至更便宜。光看價目表,兩者算是打平。

放到真實工作上就不是這樣了。寫程式的 Agent,大部分帳單都花在輸出 token 上,而 DeepSeek V4.1 Flash 每支影片寫了 229k 輸出 token,Haiku 5.5 只寫了 75k。同樣的工作,寫的量只有三分之一。token 少,也正是 Haiku 完成得更快的原因。

給正在替 Agent 挑模型的人一個結論:要比的是每個完成任務的成本,不是每個 token 的成本。 一個話少、直奔答案的模型,完全可能打敗標價更低的模型。

關於 DeepSeek 的尖峰定價

DeepSeek 依時段計費。平日 UTC 01:00 到 04:00、06:00 到 10:00,價格加倍。這次測試剛好落在尖峰時段,原始帳單上 DeepSeek 每支影片 $0.283,是 Haiku 的 6.2×。

拿這個數字當標題並不公平。我們大部分正式環境的流量都落在離峰,所以除非特別註明,本文所有比較都以 DeepSeek 離峰價計算。如果你的工作跑在亞洲上班時間或歐洲上午,實際差距會更接近 6 倍。

限制

  • 8 個專案,每個只跑一次。 生成結果本身不固定,換一組輸入,平均值可能會變。
  • 品質是我們的主觀判斷,不是基準測試分數。 每一組成品我們都看過,認為品質相當。上方那支影片就是其中一組,未經剪輯,你可以自己判斷。
  • 只涵蓋一類工作。 這是一個寫動畫程式碼的 Agent。如果工作的輸出本身就很長、無法縮短,差距可能會小一些。
  • 推理強度。 這次測試中,Haiku 5.5 撰寫分段時用的是低推理強度。我們的正式環境設定之後已經調整,換成其他推理強度,結果可能不同。

我們做了哪些調整

Claude Haiku 5.5 現在是 Motionflare 新影片的預設模型。DeepSeek V4.1 Flash 仍然可以在模型選擇器中選用。兩者都是每個場景 1 倍點數,所以這次切換讓使用者更快拿到影片,我們的營運成本也更低。

想試試的話,可以到 motionflare.ai 把任何網站做成一支影片。

常見問題

Claude Haiku 5.5 比 DeepSeek V4.1 Flash 便宜嗎?

以 token 單價來看只便宜一點:Haiku 5.5 每百萬 token 輸入 $0.10、輸出 $0.50,DeepSeek V4.1 Flash 離峰是 $0.15 和 $0.60。以完成一個任務來算就便宜很多:在我們 8 個專案的測試中,Haiku 5.5 每支影片 $0.046,DeepSeek 是 $0.142,便宜約 3 倍,原因是它的輸出 token 只有對方的三分之一左右。

Claude Haiku 5.5 比 DeepSeek V4.1 Flash 快多少?

在我們的測試中,Haiku 5.5 平均 4.6 分鐘完成一支影片,DeepSeek V4.1 Flash 要 11.8 分鐘,快 2.6 倍,而且 8 個專案全部比較快。

兩個模型的輸出品質一樣嗎?

從我們的審查來看,是的:兩個模型做出來的影片品質相當。

做 AI Agent 該選哪個模型?

在你自己的工作上實測每個完成任務的成本。就我們這個寫程式的 Agent 而言,截至 2026 年 10 月,Claude Haiku 5.5 在成本和速度上都勝過 DeepSeek V4.1 Flash。