Claude Haiku 5.5 对比 DeepSeek V4.1 Flash:真实 Agent 管线实测,便宜 3 倍、快 2.6 倍

朱乔一

朱乔一

创始人 / CEO

2026年10月8日

6 分钟读完

Claude Haiku 5.5 对比 DeepSeek V4.1 Flash:真实 Agent 管线实测,便宜 3 倍、快 2.6 倍

先说结论: 在 Motionflare 的视频生成 Agent 上,Claude Haiku 5.5 比 DeepSeek V4.1 Flash 便宜约 3 倍、快 2.6 倍,成片质量相当。2026 年 10 月 8 日我们用 8 个真实项目做了测试,Haiku 5.5 平均每支视频 $0.046、4.6 分钟;DeepSeek V4.1 Flash 平均 $0.142(按闲时价)、11.8 分钟。8 个项目里,Haiku 每一个都更便宜。

意外的是省钱的来源。按 token 单价算,两个模型差不多贵。Haiku 5.5 赢在同样的活,它只用了 三分之一的输出 token 就干完了。

同一个网站、同一段提示词、同一条管线。左边是 DeepSeek V4.1 Flash,右边是 Claude Haiku 5.5。

为什么要做这次测试

从 9 月开始,Motionflare 视频背后的默认模型一直是 DeepSeek V4.1 Flash。选它只有一个理由:在能稳定做出可交付视频的模型里,它最便宜(详见 更新日志 06)。

2026 年 10 月 7 日,Anthropic 发布了 Claude Haiku 5.5,定位是它家最便宜、最快的小模型。可一张按 token 计价的价目表,说明不了模型在真实任务上到底要花多少钱,所以我们拿真实项目让两个模型各跑一遍。

测试方法

Motionflare 能把一个网站或一段文字简介做成一支短动画视频。每支视频由一个多步骤的 Agent 生成,每一步都是一次 LLM 调用:

  1. 规划: 读取素材,逐段规划视频。
  2. 分段: 为每一段编写动画代码。
  3. 审查: 由审查环节检查渲染结果。
  4. 修复: 修掉审查指出的问题。

我们从生产环境里挑了 8 个真实用户做过的项目,在开发环境中用完全相同的输入,两个模型各跑一次。其余条件全部固定:同样的代码、同样的提示词、同样的设置。8 个输入里有 5 个网站、3 段文字简介(英语、西班牙语和阿拉伯语),每个都生成一支 10 到 15 秒的视频。

成本指整支视频的 LLM 费用,按各家返回的 token 数和各家公开价格计算。时间指从开始到成片的实际耗时。

测试结果

每支视频平均值

DeepSeek V4.1 FlashClaude Haiku 5.5差距
LLM 成本(闲时)$0.142$0.046便宜 3.1×
LLM 成本(DeepSeek 高峰时段)$0.283$0.046便宜 6.2×
生成耗时11.8 分钟4.6 分钟快 2.6×
输出 token229k75k少 3.1×

逐个项目

项目DeepSeek 成本Haiku 成本便宜倍数DeepSeek 耗时Haiku 耗时
网站 1$0.115$0.0472.4×9.6 分钟5.1 分钟
网站 2$0.126$0.0492.6×12.8 分钟4.9 分钟
简介(阿拉伯语)$0.120$0.0373.3×10.3 分钟3.5 分钟
简介(西班牙语)$0.202$0.0514.0×13.2 分钟4.8 分钟
网站 3$0.150$0.0443.4×12.0 分钟4.1 分钟
简介(英语)$0.196$0.0503.9×15.8 分钟5.8 分钟
网站 4(荷兰语)$0.065$0.0322.0×7.1 分钟3.3 分钟
网站 5(即上面的视频)$0.159$0.0562.9×13.6 分钟5.1 分钟

表中 DeepSeek 的成本均按闲时价计算。Haiku 5.5 在每个项目上都更便宜,幅度在 2.0× 到 4.0× 之间;也在每个项目上都更快,幅度在 1.9× 到 2.9× 之间。

Haiku 5.5 为什么更便宜:省在 token,不在单价

先看两家公开的每百万 token 价格:

每 1M tokenDeepSeek V4.1 Flash(闲时)DeepSeek V4.1 Flash(高峰)Claude Haiku 5.5
输入$0.15$0.30$0.10
缓存输入$0.003$0.006$0.01
输出$0.60$1.20$0.50

闲时价下,Haiku 5.5 的单价只便宜一点点,DeepSeek 的缓存输入反而更便宜。光看价目表,两者算是打平。

放到真实任务上就不是这样了。写代码的 Agent,大部分账单花在输出 token 上,而 DeepSeek V4.1 Flash 每支视频写了 229k 输出 token,Haiku 5.5 只写了 75k。同样的活,写的量只有三分之一。token 少,也正是 Haiku 出片更快的原因。

给正在为 Agent 选模型的人一个结论:比的是每个完成任务的成本,不是每个 token 的成本。 一个话少、直奔答案的模型,完全可以打败标价更低的模型。

关于 DeepSeek 的高峰定价

DeepSeek 按时段计费。工作日 UTC 01:00 到 04:00、06:00 到 10:00,价格翻倍。这次测试正好落在高峰时段,原始账单上 DeepSeek 每支视频 $0.283,是 Haiku 的 6.2×。

拿这个数字做标题并不公平。我们大部分生产流量都在闲时,所以除非特别说明,本文所有对比都按 DeepSeek 闲时价计算。如果你的任务跑在亚洲工作时间或欧洲上午,实际差距会更接近 6 倍。

局限

  • 8 个项目,每个只跑一次。 生成结果本身不确定,换一组输入,平均值可能会变。
  • 质量是我们的主观判断,不是基准测试分数。 每一组成片我们都看过,认为质量相当。上面那支视频就是其中一组,未经剪辑,你可以自己判断。
  • 只覆盖一类任务。 这是一个写动画代码的 Agent。如果任务的输出本身很长、压缩不了,差距可能会小一些。
  • 推理强度。 这次测试中,Haiku 5.5 写分段时用的是低推理强度。我们的生产设置之后已经调整,换成其他推理强度,结果可能不同。

我们做了什么调整

Claude Haiku 5.5 现在是 Motionflare 新视频的默认模型。DeepSeek V4.1 Flash 仍然可以在模型选择器里选到。两者都是每场景 1 倍积分,所以这次切换让用户出片更快,我们的运行成本也更低。

想试试的话,可以在 motionflare.ai 把任意网站做成一支视频。

常见问题

Claude Haiku 5.5 比 DeepSeek V4.1 Flash 便宜吗?

按 token 单价只便宜一点:Haiku 5.5 每百万 token 输入 $0.10、输出 $0.50,DeepSeek V4.1 Flash 闲时是 $0.15 和 $0.60。按完成一个任务算就便宜多了:在我们 8 个项目的测试里,Haiku 5.5 每支视频 $0.046,DeepSeek 是 $0.142,便宜约 3 倍,原因是它的输出 token 只有对方的三分之一左右。

Claude Haiku 5.5 比 DeepSeek V4.1 Flash 快多少?

在我们的测试里,Haiku 5.5 平均 4.6 分钟出一支视频,DeepSeek V4.1 Flash 要 11.8 分钟,快 2.6 倍,而且 8 个项目全部更快。

两个模型的输出质量一样吗?

从我们的审查来看,是的:两个模型做出来的视频质量相当。

做 AI Agent 该选哪个模型?

在你自己的任务上实测每个完成任务的成本。就我们这个写代码的 Agent 而言,截至 2026 年 10 月,Claude Haiku 5.5 在成本和速度上都胜过 DeepSeek V4.1 Flash。