Claude Haiku 5.5 对比 DeepSeek V4.1 Flash:真实 Agent 管线实测,便宜 3 倍、快 2.6 倍
朱乔一
创始人 / CEO
2026年10月8日
6 分钟读完

先说结论: 在 Motionflare 的视频生成 Agent 上,Claude Haiku 5.5 比 DeepSeek V4.1 Flash 便宜约 3 倍、快 2.6 倍,成片质量相当。2026 年 10 月 8 日我们用 8 个真实项目做了测试,Haiku 5.5 平均每支视频 $0.046、4.6 分钟;DeepSeek V4.1 Flash 平均 $0.142(按闲时价)、11.8 分钟。8 个项目里,Haiku 每一个都更便宜。
意外的是省钱的来源。按 token 单价算,两个模型差不多贵。Haiku 5.5 赢在同样的活,它只用了 三分之一的输出 token 就干完了。
同一个网站、同一段提示词、同一条管线。左边是 DeepSeek V4.1 Flash,右边是 Claude Haiku 5.5。
为什么要做这次测试
从 9 月开始,Motionflare 视频背后的默认模型一直是 DeepSeek V4.1 Flash。选它只有一个理由:在能稳定做出可交付视频的模型里,它最便宜(详见 更新日志 06)。
2026 年 10 月 7 日,Anthropic 发布了 Claude Haiku 5.5,定位是它家最便宜、最快的小模型。可一张按 token 计价的价目表,说明不了模型在真实任务上到底要花多少钱,所以我们拿真实项目让两个模型各跑一遍。
测试方法
Motionflare 能把一个网站或一段文字简介做成一支短动画视频。每支视频由一个多步骤的 Agent 生成,每一步都是一次 LLM 调用:
- 规划: 读取素材,逐段规划视频。
- 分段: 为每一段编写动画代码。
- 审查: 由审查环节检查渲染结果。
- 修复: 修掉审查指出的问题。
我们从生产环境里挑了 8 个真实用户做过的项目,在开发环境中用完全相同的输入,两个模型各跑一次。其余条件全部固定:同样的代码、同样的提示词、同样的设置。8 个输入里有 5 个网站、3 段文字简介(英语、西班牙语和阿拉伯语),每个都生成一支 10 到 15 秒的视频。
成本指整支视频的 LLM 费用,按各家返回的 token 数和各家公开价格计算。时间指从开始到成片的实际耗时。
测试结果
每支视频平均值
| DeepSeek V4.1 Flash | Claude Haiku 5.5 | 差距 | |
|---|---|---|---|
| LLM 成本(闲时) | $0.142 | $0.046 | 便宜 3.1× |
| LLM 成本(DeepSeek 高峰时段) | $0.283 | $0.046 | 便宜 6.2× |
| 生成耗时 | 11.8 分钟 | 4.6 分钟 | 快 2.6× |
| 输出 token | 229k | 75k | 少 3.1× |
逐个项目
| 项目 | DeepSeek 成本 | Haiku 成本 | 便宜倍数 | DeepSeek 耗时 | Haiku 耗时 |
|---|---|---|---|---|---|
| 网站 1 | $0.115 | $0.047 | 2.4× | 9.6 分钟 | 5.1 分钟 |
| 网站 2 | $0.126 | $0.049 | 2.6× | 12.8 分钟 | 4.9 分钟 |
| 简介(阿拉伯语) | $0.120 | $0.037 | 3.3× | 10.3 分钟 | 3.5 分钟 |
| 简介(西班牙语) | $0.202 | $0.051 | 4.0× | 13.2 分钟 | 4.8 分钟 |
| 网站 3 | $0.150 | $0.044 | 3.4× | 12.0 分钟 | 4.1 分钟 |
| 简介(英语) | $0.196 | $0.050 | 3.9× | 15.8 分钟 | 5.8 分钟 |
| 网站 4(荷兰语) | $0.065 | $0.032 | 2.0× | 7.1 分钟 | 3.3 分钟 |
| 网站 5(即上面的视频) | $0.159 | $0.056 | 2.9× | 13.6 分钟 | 5.1 分钟 |
表中 DeepSeek 的成本均按闲时价计算。Haiku 5.5 在每个项目上都更便宜,幅度在 2.0× 到 4.0× 之间;也在每个项目上都更快,幅度在 1.9× 到 2.9× 之间。
Haiku 5.5 为什么更便宜:省在 token,不在单价
先看两家公开的每百万 token 价格:
| 每 1M token | DeepSeek V4.1 Flash(闲时) | DeepSeek V4.1 Flash(高峰) | Claude Haiku 5.5 |
|---|---|---|---|
| 输入 | $0.15 | $0.30 | $0.10 |
| 缓存输入 | $0.003 | $0.006 | $0.01 |
| 输出 | $0.60 | $1.20 | $0.50 |
闲时价下,Haiku 5.5 的单价只便宜一点点,DeepSeek 的缓存输入反而更便宜。光看价目表,两者算是打平。
放到真实任务上就不是这样了。写代码的 Agent,大部分账单花在输出 token 上,而 DeepSeek V4.1 Flash 每支视频写了 229k 输出 token,Haiku 5.5 只写了 75k。同样的活,写的量只有三分之一。token 少,也正是 Haiku 出片更快的原因。
给正在为 Agent 选模型的人一个结论:比的是每个完成任务的成本,不是每个 token 的成本。 一个话少、直奔答案的模型,完全可以打败标价更低的模型。
关于 DeepSeek 的高峰定价
DeepSeek 按时段计费。工作日 UTC 01:00 到 04:00、06:00 到 10:00,价格翻倍。这次测试正好落在高峰时段,原始账单上 DeepSeek 每支视频 $0.283,是 Haiku 的 6.2×。
拿这个数字做标题并不公平。我们大部分生产流量都在闲时,所以除非特别说明,本文所有对比都按 DeepSeek 闲时价计算。如果你的任务跑在亚洲工作时间或欧洲上午,实际差距会更接近 6 倍。
局限
- 8 个项目,每个只跑一次。 生成结果本身不确定,换一组输入,平均值可能会变。
- 质量是我们的主观判断,不是基准测试分数。 每一组成片我们都看过,认为质量相当。上面那支视频就是其中一组,未经剪辑,你可以自己判断。
- 只覆盖一类任务。 这是一个写动画代码的 Agent。如果任务的输出本身很长、压缩不了,差距可能会小一些。
- 推理强度。 这次测试中,Haiku 5.5 写分段时用的是低推理强度。我们的生产设置之后已经调整,换成其他推理强度,结果可能不同。
我们做了什么调整
Claude Haiku 5.5 现在是 Motionflare 新视频的默认模型。DeepSeek V4.1 Flash 仍然可以在模型选择器里选到。两者都是每场景 1 倍积分,所以这次切换让用户出片更快,我们的运行成本也更低。
想试试的话,可以在 motionflare.ai 把任意网站做成一支视频。
常见问题
Claude Haiku 5.5 比 DeepSeek V4.1 Flash 便宜吗?
按 token 单价只便宜一点:Haiku 5.5 每百万 token 输入 $0.10、输出 $0.50,DeepSeek V4.1 Flash 闲时是 $0.15 和 $0.60。按完成一个任务算就便宜多了:在我们 8 个项目的测试里,Haiku 5.5 每支视频 $0.046,DeepSeek 是 $0.142,便宜约 3 倍,原因是它的输出 token 只有对方的三分之一左右。
Claude Haiku 5.5 比 DeepSeek V4.1 Flash 快多少?
在我们的测试里,Haiku 5.5 平均 4.6 分钟出一支视频,DeepSeek V4.1 Flash 要 11.8 分钟,快 2.6 倍,而且 8 个项目全部更快。
两个模型的输出质量一样吗?
从我们的审查来看,是的:两个模型做出来的视频质量相当。
做 AI Agent 该选哪个模型?
在你自己的任务上实测每个完成任务的成本。就我们这个写代码的 Agent 而言,截至 2026 年 10 月,Claude Haiku 5.5 在成本和速度上都胜过 DeepSeek V4.1 Flash。