Seedance 2.0 对比 Wan(2026):$0.04/s 与 $0.10/s 的视频 API 之争

Seedance 2.0 每秒 $0.04–$0.07,比 Wan 的 $0.10/s 便宜 30–60%,还多出 4K 和三档定价。本文给出单条成本算法、真实规格,以及一次 ofox 调用同时 A/B 两家的方法。

Seedance 2.0 对比 Wan(2026):$0.04/s 与 $0.10/s 的视频 API 之争

TL;DR: 两个中国视频模型,一个端点,一道清晰的价差。 字节跳动的 Seedance 2.0 三档定价 $0.04–$0.07/s,旗舰档能到 4K。阿里巴巴的 Wan 统一 $0.10/s,上限 1080p。同样的片子,Seedance 在 1080p 便宜约 30%,Mini 档便宜约 60%。Wan 的价格靠更短的最短时长(2s 对 4s)和阿里的运动一致性来撑。两家都在同一个 ofox POST /v1/videos 调用后面,所以你改一个字符串就能 A/B,而不必搭起两套 SDK。

到底该选哪个?

如果你要批量生成短产品片、社媒剪辑或广告变体,成本这笔账指向 Seedance 2.0。它在每个对应分辨率上都更便宜,Mini 档能把一条 $0.50 的 Wan 片子变成 $0.20。如果你需要 4 秒以下的片子,或者你已经调顺了阿里的运动和 prompt 表现,那么尽管单价更高,Wan 仍是更稳妥的选择。

场景选择理由
高频量产、1080p 的 5–10s 片段Seedance 2.0$0.07/s 对 $0.10/s,同分辨率
预算最紧、能接受 720pSeedance 2.0 Mini$0.04/s,比 Wan 低约 60%
需要 4K 输出Seedance 2.0两家里唯一列出 4K 的
短于 4 秒的片子Wan 2.7最短 2s,Seedance 是 4s
已经调顺了阿里的运动表现Wan 2.7迁移成本盖过价差
还拿不准两个都跑一个端点,改一个字符串

下面全是支撑这张表的算法和规格,外加一次调用同时跑两家的完整代码。

快速规格对比

这里所有数字都来自 2026-07-19 当天的 ofox 线上模型目录。两个系列都提供文生视频、图生视频和同步音频。真正拉开差距的是分辨率上限、最短时长和价格。

规格Seedance 2.0Seedance 2.0 FastSeedance 2.0 MiniWan 2.7Wan 2.6
Model IDbytedance/seedance-2.0bytedance/seedance-2.0-fastbytedance/seedance-2.0-minialibaba/wan-2.7alibaba/wan-2.6
每秒价格$0.07$0.06$0.04$0.10$0.10
最高分辨率4K720p720p1080p1080p
默认分辨率1080p720p720p1080p1080p
模式t2v, i2v, v2vt2v, i2v, v2vt2v, i2v, v2vt2v, i2v, v2vt2v, i2v
时长区间4–15s4–15s4–15s2–15s2–15s
音频支持支持支持支持支持
画幅比例16:9, 9:16, 1:1, adaptive同上同上16:9, 9:16, 1:116:9, 9:16, 1:1
端点/v1/videos/v1/videos/v1/videos/v1/videos/v1/videos

有两点很突出。Seedance 是唯一能上 4K 的一方,而且是在那个本就在价格上压过 Wan 的旗舰档上做到的。Wan 的优势在短端:2 秒的最低时长让你能做出 Seedance 在 4 秒以下做不出的紧凑循环片和短转场。如果你的格式落在 6–10 秒区间,那道地板永远不会触发,价差就是全部的故事。

Seedance 和 Wan 各自的来历

这两个模型可以追溯到中国视频生成研究最深的两家实验室。Seedance 属于字节跳动的 Seed 团队,也就是打造了 Seedream 图像模型、以及供养抖音和 TikTok 短视频管线的那支队伍。Wan 出自阿里巴巴的通义系列,与 Qwen 家族和 Model Studio 平台一同研发。你可以在 字节 Seed 的 Seedance 页面Wan 项目官网看到厂商资料。

对开发者来说,血统不如接入路径重要。两个模型都是先在中国训练和部署,这在过去意味着各自独立的控制台、独立的计费,以及不一定接受外国号码的手机验证。把它们经 ofox 网关路由,就把这一切压成一个 key 和一个端点,这也是这篇对比谈的是模型本身、而非那堆手续的实际原因。真正值得决策的是价格和能力,而不是你能登进哪个控制台。

这个框架也顺便点出了规格表的一个诚实局限。字节和阿里都是围绕各自主场平台调优的,所以运动风格、默认节奏和 prompt 理解会以规格表捕捉不到的方式产生差异。唯一能看清的办法是把同一个 prompt 分别跑一遍两家,这正是下一节要做的。

同 Prompt 实测:价差换来了什么

价格和规格表把简单的部分说清了。更难的问题是:更便宜的模型在运动、prompt 贴合度和音频同步上顶不顶得住。规格对等不等于输出对等,所以这一节把同一个 prompt 分别跑一遍两家旗舰档,然后比对结果,而不是听信规格表。

测试 prompt 一,各模型保持完全一致,1080p,16:9,8 秒,开音频:

“A ceramic coffee cup on a wooden table, morning light from a window, steam rising, a hand enters frame and lifts the cup. Ambient cafe sound.”

同一条咖啡杯 prompt 各取四帧:上排为 Seedance 2.0,下排为 Wan 2.7,均为 1080p

同一个 prompt,每个模型取四帧,Seedance 2.0(上)与 Wan 2.7(下)。两家都渲染出了杯子、蒸汽和暖色窗光;注意看那只手在四帧里的表现。

同样这两段片子的动态并排:Seedance 2.0(左)、Wan 2.7(右),循环静音播放。Seedance 一侧那只手入画并端起了杯子;Wan 一侧杯子和蒸汽稳住了,但端起的动作几乎看不出来。

评估项Seedance 2.0Wan 2.7说明
Prompt 贴合度(物体、动作)完整:手入画并端起杯子部分:杯子和蒸汽到位,端起动作几乎看不出那只手到底有没有把杯子端起来
运动连贯性(无扭曲)四帧全程干净四帧全程干净蒸汽和手部物理在各帧间的表现
音频电平(实测)完整同步声底,均值 -34 dB / 峰值 -5 dB有但很弱,均值 -43 dB / 峰值 -30 dB两家都附带同步音轨;这条片子里 Wan 的大约要低 9 dB
这条 8s 片子的成本$0.56$0.808 × 每秒价格

成本这一行由价目表钉死:一条 8 秒的 1080p 片子在 Seedance 2.0 上是 $0.56,在 Wan 2.7 上是 $0.80,每条相差 $0.24。质量那几行来自上面生成的样本,而非厂商说辞。

单一的平静 prompt 压不出视频模型的极限,所以一个公平的测试还需要一个运动量大、便宜模型容易翻车的 prompt。测试 prompt 二,设置相同:

“A skateboarder does a kickflip down a set of stairs, fast camera pan, crowd in the background, daytime.”

滑板 kickflip prompt 各取四帧:上排为 Seedance 2.0,下排为 Wan 2.7

运动量大的那个 prompt:Seedance 2.0(上)在整个动作里把板子、脚和背景人群都稳住了;Wan 2.7(下)保住了远景,但在序列中段漂移成了一个扭曲的特写。

动态讲出了静帧讲不出的故事:Seedance 2.0(左)、Wan 2.7(右),循环播放。Seedance 一侧板子和脚在整个翻转过程中都锁得很稳;Wan 一侧中途突跳到一个扭曲的特写,之后才恢复远景。

这就是把各档拉开的那个 prompt。快速镜头运动加上刚体特技再加上背景人群,正是扭曲、肢体复制和物理漂移会冒出来的地方。判断两段片子时,看板子和脚在翻转全程有没有稳住、镜头横摇有没有把背景抹花。把两个 prompt 都在 bytedance/seedance-2.0alibaba/wan-2.7 上跑一遍,在你把管线押给任一家之前,把两段片子并排看一遍。时长越长,这种效应越叠加:到了 15 秒,微小的逐帧漂移会累积,所以如果你的格式偏长,就用你真实的时长去测,而不是拿个稳妥的 5 秒样本。

异步工作流:提交、轮询,或走 Webhook

视频生成不像 chat completion 那样是一次阻塞式请求。ofox 的 POST /v1/videos 调用会立即返回 202 Accepted 和一个 polling_url。片子在后台渲染,你有两种方式知道它渲染好了:轮询任务,或注册一个 webhook。

任务会在一个小状态机里流转。你要么持续查询,要么等回调,直到它抵达某个终态。

ofox /v1/videos async task state machineAsync task lifecycleOne POST /v1/videos, then poll or webhook until a terminal state202 Accepted+ polling_urlpendingqueuedprocessingrenderingDELETETTLcompleteddownload clipfailedread error, retrycancelledyou stopped itexpiredTTL elapsed, regenterminal states — polling stops here

任务会流转过三个活动状态,然后停在四个终态之一。轮询 GET /v1/videos/{id} 或注册一个 webhook;DELETE 取消任务,结果按 TTL 过期。

字段 / 状态含义该做什么
202 + polling_url任务已受理,开始渲染保存该 URL,开始轮询
status: pending已排队,尚未开始继续轮询,不快于 1/s
status: processing渲染进行中继续轮询
status: completed完成,附带结果 URL下载片子
status: failed生成出错读取 error,重试或回退
status: cancelled你调了 DELETE停止
status: expired结果 TTL 到期重新生成

有两个操作细节能帮你省下一张工单。第一,轮询不要快于每秒一次;GET /v1/videos/{id} 端点有限流保护,紧循环会被限速。第二,生产环境里你通常想用 webhook 而不是轮询。创建任务时传入一个 callback_url,片子完成时 ofox 会 POST 一份 HMAC 签名的载荷。该 URL 必须是 HTTPS 且公网可达:私网、回环和云元数据地址会被 SSRF 校验拒绝,坏地址会在创建时就以 400 invalid_callback_url 失败。如果你要中止一次运行,DELETE /v1/videos/{id} 会取消它。这一切对 Seedance 和 Wan 完全相同,这正是关键:换模型时,操作面不会变。

常见错误与坑

两个模型的多数失败都来自同一小撮不匹配,而不是模型本身。

现象原因修法
Seedance 上 2–3s 的片子报 400Seedance 最短时长是 4s改用 Wan(2s 地板)或把时长提到 4s
Fast / Mini 上分辨率被拒Fast 和 Mini 上限 720p请求 720p,或用旗舰 bytedance/seedance-2.0 出 1080p / 4K
400 invalid_callback_urlWebhook 不是 HTTPS 或指向私网地址用一个公网 HTTPS 端点
任务卡在轮询里出不来轮询太快被限速,或没处理终态轮询 ≤1/s,遇到 completed / failed / cancelled / expired 就跳出
想要 i2v 却拿到了 t2v载荷里没图frame_images(或 input_references)来触发图像模式
画幅比例不对Wan 没有 adaptive 选项设一个明确的比例;只有 Seedance 支持 adaptive

模式推断这个行为最容易让人措手不及。端点不吃 mode 标志,它读你的载荷。没有图就是文生视频,frame_images 就是图像或首/尾帧,input_references 就是参考图引导。这让两个模型系列的调用形态保持一致,但也意味着漏填一个图像字段会静默给你错的模式,而不是报错。

Prompt 与音频:实用笔记

两个模型都不需要什么特殊的 prompt 方言,但几个习惯能提高双方的命中率。对文生视频,把主体、动作、镜头、场景拆成各自独立的分句来描述,而不是写成一句长句子;比起一堆形容词砌墙,两个系列都更可靠地解析”谁、在干什么、怎么拍、在哪”。让动作保持单一。一个 prompt 要在八秒里同时要 kickflip、人群反应和一道镜头光晕,通常只能拿到三者之一,所以三者都要就串接多条更短的片子,别把一次生成塞爆。

这里每一档默认都开着音频,这会改变你的写法。因为两个模型都会生成同步声底,一个提到”ambient cafe sound”或”footsteps on gravel”的 prompt 会拿到匹配的音轨,而一个对声音只字未提的 prompt 会拿到模型自己推断的东西,而那不一定是你想要的。点名你期望的音频,否则你就得接受一个猜测。如果你要把片子合进带你自己声音设计的时间线里,那条生成的声底就是你得剥掉的噪音,所以把音频当成一个决策,而不是一份白送的赠品。

对图生视频,你传入的那一帧比 prompt 更重要。一张干净、高分辨率、主体已经构好图的首帧,能给两个模型一个稳定锚点,之后 prompt 只需描述运动即可:“slow push in”、“hair moves in the wind”、“camera orbits left”。Seedance 的 adaptive 画幅比例在这里帮得上忙,因为它能匹配你递进去的那一帧,而不是硬裁,这意味着一张参考图可以在不重新构图的情况下驱动一个 16:9 和一个 9:16 输出。Wan 需要一个明确的比例,所以提交前先把裁切规划好。

定价算法:真实的月度账单

每秒单价在你没乘上自己的用量之前都是抽象的。这里给个具体管线:一个小内容团队每月生成 2,000 条片子,每条 5 秒,1080p,这对一个跑产品和促销变体的电商或社媒团队来说是个真实的节奏。

模型单价每条 5s 片子每月 2,000 条
Seedance 2.0 Mini (720p)$0.04/s$0.20$400
Seedance 2.0 Fast (720p)$0.06/s$0.30$600
Seedance 2.0 (1080p)$0.07/s$0.35$700
Wan 2.7 (1080p)$0.10/s$0.50$1,000

Monthly video bill by model tierMonthly bill: 2,000 clips/month, 5s eachSame volume, four tiers — the rate card is the whole difference$0$250$500$750$1,000$400Mini720p · $0.04/s$600Fast720p · $0.06/s$700Flagship1080p · $0.07/s$1,000Wan 2.71080p · $0.10/s30% under Wan60% under Wan

在同为 1080p 时,Seedance 旗舰每月比 Wan 便宜 $300;降到 Mini 的 720p,同样 2,000 条每月省下 $600。

在同为 1080p 时,Seedance 2.0 每月为这个团队省下 $300,砍掉 30%。如果格式能接受 720p(信息流和 story 版位通常都行),Mini 档每月省 $600,砍掉 60%,同样是 2,000 条。一年下来就是 $3,600 到 $7,200 留在了预算里。

更聪明的打法不是押一档,而是一条路由阶梯。草稿和被否的变体用 Mini 在 $0.04/s 上生成,被批准的方案提升到 Fast 或旗舰做最终渲染,把 4K 旗舰留给客户真会做母版的 hero 片。因为三个 Seedance 档共用 bytedance/seedance-2.0 前缀和一个端点,那条阶梯是你自己代码里的一个 switch 语句,而不是三套集成。一个拍 2,000 条草稿但只完成 200 条的团队,大约每月付 1,800 × 5 × $0.04 + 200 × 5 × $0.07 = $360 + $70 = $430,不到全旗舰账单的一半,也远低于 Wan 的 $1,000。

反面情形也真实存在。如果你的片子跑 2 到 3 秒,Seedance 根本生成不了(它的地板是 4 秒),所以对这种格式,Wan 的实际价格不是”更贵”,而是”两家里唯一的选项”。在把模型匹配到价格之前,先把模型匹配到格式。

分辨率与时长:账单真正的来源

两个模型都按秒计费,这带来一个人们在第一张发票上会漏掉的后果:价差随片长放大。5 秒时,Seedance 对 Wan 的差是 $0.15。15 秒时,也就是两个模型都允许的上限,是 $1.05 对 $1.50,单条片子相差 $0.45。生成个几千条长片,模型的选择就成了财务团队会注意到的一笔明细。短片藏住价差,长片把它暴露出来。

Per-clip cost vs duration, Seedance 2.0 vs Wan 2.7Per-clip cost by duration (1080p)Billed per second, so the price gap grows with clip length$0$0.50$1.00$1.504s5s8s12s15sclip duration (seconds)$0.15$0.45 gapSeedance 2.0 · $0.07/sWan 2.7 · $0.10/s

两条线在 4 秒处贴得很近,随着片子变长而分开,阴影带就是选 Seedance 每条能省下的部分。

分辨率是另一根轴,也是 Seedance 旗舰真正值回本钱的地方。它是两家里唯一列出 4K 的。诚实的问题是你需不需要。多数社媒分发的上限就是 1080p:Instagram、TikTok 和 YouTube Shorts 都会把更高的降采样,所以为了喂一条竖版 story 而付 4K 的钱就是把钱点着烧。4K 真正有用的地方是会被再编辑的母版、会被裁切或推近的 VFX 底板,以及任何客户会按全分辨率归档的交付物。如果那就是你的活儿,Seedance 旗舰是这里唯一的选项,而且它在每秒单价上仍比 Wan 的 1080p 便宜,所以那点分辨率余量相对于替代方案基本是白送的。

实用规则:按你的分发上限选分辨率,而不是按规格表上最高的数字,然后挑能达标的最便宜那一档。给信息流用,就是 720p 的 Seedance Mini。给 1080p 母版用,就是 Seedance 旗舰。只有当片子短于四秒、或者你已经在阿里体系里标准化了,Wan 才进入决策,而不是在你优化账单时。

什么时候选 Seedance 2.0

当量和分辨率都重要时,伸手去拿 Seedance 2.0。三档结构让你能按任务把成本对上质量,而不是付一个统一单价:Mini 给用完即弃的变体和草稿,Fast 给批准的 720p 输出,旗舰给需要 1080p 或 4K 的 hero 片。因为三档共用一个 model-ID 前缀和一个端点,你可以在自己代码里按档路由,完全不碰鉴权。

对电商产品视频、社媒广告变体,以及任何你要生成成百上千条短片并反复迭代的管线,它都是对的默认选择。旗舰的 4K 上限也意味着客户一开口要更高分辨率母版时你不会立刻用超。adaptive 画幅比例在这里也是个低调的便利:面对 16:9、9:16 和 1:1 版位混排的信息流,你可以让模型去适配画幅,而不必维护三套 prompt 变体。

它的短板:4 秒以下什么都做不了,而且便宜的几档止步 720p。如果你整个生意就是 2 秒循环片,或者预算内非要 1080p 起步的输出,那分档算法就帮不上忙了。

什么时候选 Wan

当片子短、或者你已经深投阿里技术栈时,选 Wan 2.7。2 秒的最短时长是 Seedance 没有的一项真实能力,对循环片、短转场和微转场来说,那道地板才是决定因素,而不是单价。Wan 2.7 还加了视频生视频,这是 Wan 2.6 缺的,所以要延长或改风格已有素材就用 2.7。

还有一个切换成本的论点。如果你有针对 Wan 行为调好的 prompt 库、参考图集或 QA 基线,每条 $0.24 的价差未必能盖过把这一切重调到新模型的成本。价格只是一个输入,迁移账单是另一个。而如果你在图像和语言上已经统一到阿里,把视频留在同一家里,为了一段厂商关系和一套内容政策,也可能值得付一点溢价。

什么时候两个都不选(以及改用什么)

Seedance 和 Wan 都不是每种活儿的答案。

  • 你需要同步口型对白或数字人主播。 HappyHorse 1.1(alibaba/happyhorse-1.0 / alibaba/happyhorse-1.1,$0.13/s)是围绕口型同步和多参考图的图生视频打造的,最多吃 9 张参考图。它每秒更贵,但对说话人头像这种格式,它做的是别家做不到的事。
  • 你需要西方市场规模化的写实感,或者就是要 Sora 和 Veo。 那些跑在各自的原生 API 上,不是 /v1/videos。我们在 AI 视频生成 API 横评:Sora 2 Pro 对比 Veo 3.1 对比 Kling 2.6 Pro 里比过它们,那里的结论和本文相反:三个模型、三套独立 SDK、没有共享端点。如果你名单上就锁定 Kling,Kling 2.6 Pro 视频 API 指南 从头到尾都讲到了。
  • 你的工作负载是图像,不是视频。 出静图的话,字节的图像姊妹产品在 Seedream 4.5 豆包图像 API 里有讲。

经 ofox 同时试两家:一个端点、10 行代码 A/B

这就是 Seedance 对 Wan 不再是纸面之争的地方。因为两家都在 ofox 的 POST /v1/videos 后面,你改一下 model 字符串就切换了模型。调用是异步的,就是上文描述的那样:提交、拿到 polling_url、轮询到 completed

按量付费从 bytedance/seedance-2.0-mini$0.04/s 起步,同一个 key 就能跑 ofox 视频目录 里的每一个模型,所以你可以在押上一分钱做量之前先把两家都基准测一遍。

用 Python A/B 两个模型

import os, time, requests

OFOX = "https://api.ofox.ai/v1"
HEAD = {"Authorization": f"Bearer {os.environ['OFOX_API_KEY']}"}

def generate(model, prompt):
    r = requests.post(f"{OFOX}/videos", headers=HEAD, json={
        "model": model,
        "prompt": prompt,
        "duration": 8,
        "resolution": "1080p",
        "aspect_ratio": "16:9",
    })
    r.raise_for_status()
    poll = r.json()["polling_url"]        # 202 + polling_url
    while True:
        s = requests.get(poll, headers=HEAD).json()
        if s["status"] in ("completed", "failed", "cancelled", "expired"):
            return model, s
        time.sleep(2)                     # poll no faster than 1/s

prompt = "A ceramic coffee cup on a wooden table, morning light, steam rising."
for model in ("bytedance/seedance-2.0", "alibaba/wan-2.7"):
    print(*generate(model, prompt))       # swap the string, same call

Node 里的同一个调用

const OFOX = "https://api.ofox.ai/v1";
const HEAD = { Authorization: `Bearer ${process.env.OFOX_API_KEY}`,
               "Content-Type": "application/json" };

async function generate(model, prompt) {
  const res = await fetch(`${OFOX}/videos`, {
    method: "POST", headers: HEAD,
    body: JSON.stringify({ model, prompt, duration: 8,
                           resolution: "1080p", aspect_ratio: "16:9" }),
  });
  let { polling_url } = await res.json();          // 202 + polling_url
  while (true) {
    const s = await (await fetch(polling_url, { headers: HEAD })).json();
    if (["completed", "failed", "cancelled", "expired"].includes(s.status))
      return { model, s };
    await new Promise(r => setTimeout(r, 2000));   // poll no faster than 1/s
  }
}

const prompt = "A ceramic coffee cup on a wooden table, morning light, steam rising.";
for (const model of ["bytedance/seedance-2.0", "alibaba/wan-2.7"])
  console.log(await generate(model, prompt));      // one string swaps the model

图生视频:同一个调用,加一帧

要用一张静图驱动任一模型,传入 frame_images 而不是光靠 prompt。端点会读载荷,切到图生视频,不用换一个路由:

r = requests.post(f"{OFOX}/videos", headers=HEAD, json={
    "model": "bytedance/seedance-2.0",
    "prompt": "camera slowly pushes in, steam rises",
    "frame_images": ["https://example.com/first-frame.png"],
    "duration": 8,
    "resolution": "1080p",
})

两个模型系列,一套鉴权,一套 schema。这就是该去 A/B 它们、而不是照着规格表拍板的实际原因。

FAQ

Seedance 2.0 比 Wan 便宜吗? 便宜。Seedance 2.0 在 1080p 下是 $0.07/s,Wan 是统一的 $0.10/s,而 Fast 和 Mini 两档降到 $0.06/s 和 $0.04/s。一条 5 秒的 1080p 片子就是 $0.35 对 $0.50。

Seedance 2.0 在 ofox 上的 model ID 是什么? bytedance/seedance-2.0bytedance/seedance-2.0-fastbytedance/seedance-2.0-mini。Wan 是 alibaba/wan-2.7alibaba/wan-2.6

Seedance 2.0 支持 4K 吗? 旗舰 bytedance/seedance-2.0 档列出了 4K。Fast 和 Mini 上限 720p,Wan 上限 1080p。

两家都能生成音频吗? 能。全部 Seedance 2.0 档位和两个 Wan 版本都列出了同步音频。Wan 从 2 秒起步,Seedance 从 4 秒。

需要各自单独的 API key 吗? 不需要。两家都走同一个 ofox key 和 POST /v1/videos。切换模型是改一个字符串的事。

图生视频哪家更好? 两家都列出了 i2v。Seedance 三档都加了 v2v;Wan 2.7 加了 v2v,Wan 2.6 没有。

现在 ofox 上最便宜的视频模型是哪个? bytedance/seedance-2.0-mini,$0.04/s,上限 720p。

本文核实来源