Seedance 做小说转视频:一集三分钟 43 美元,抽卡率说了算
Seedance 做小说转视频,三段里只有一段真花钱:剧本 0.0027 美元,视频 43.20。抽 7.5 次一集 ¥2,300,和漫剧行业 500 元/集的口径差在哪,文里对过账。
一条三分钟的片子,剧本花你 0.0027 美元,视频花你 43.20 美元。 这两个数差约 1.5 万倍,而它决定了这篇文章后面所有的建议:拆分镜用哪个模型不值得纠结,改提示词模板也省不出钱,唯一能动的地方是视频那一段,以及你要抽几次卡才得一条能用的。
好消息是这条链比多数人以为的短——音频那段不用做。
下面每个价格都取自公开价目,2026-08-31 当日回源。利益披露:Ofox 是本文用来算账的网关之一,价格是我们自己的公开挂牌价。
小说到成片,这条链有几段?
三段,但只有两段要你动手。
| 段 | 做什么 | 谁来做 | 每集成本 |
|---|---|---|---|
| 拆分镜 | 小说 → 分镜脚本与提示词 | 文本模型 | 约 $0.0027 |
| 生成 | 分镜 → 带声音的视频片段 | Seedance 2.5 | $43.20 起 |
| 配音 | — | 不用做 | $0 |
第三段之所以是空的,是因为 Seedance 2.5 的输出默认就带同步音频。很多人照搬上一代的流程图,在生成之后再挂一段 TTS,结果是给已经有声音的素材再配一次音。要不要音频只由请求里的 generate_audio 决定,而这一项影响的是内容不是价格,两条路都是。Ofox 模型页的价目表有一列专门标音频,每一行都写「任意」;字节那边按 token 计价,公式 (输入视频时长 + 输出视频时长) × 宽 × 高 × 帧率 ÷ 1024 里没有音频项,而那套区分有声无声的换算系数,文档写明只适用于 Seedance 1.5 Pro——原文是「Other models do not support this mode for now」。
关键帧那一步是可选的。你可以先用图像模型出一张定妆图再走图生视频,也可以直接文生视频。走图这条路每张约 0.03 到 0.05 美元,在总账里同样是零头。
一集三分钟,每段各花多少钱?
先把一次过的账算干净,再谈现实。
一集按 180 秒、720p、文生视频算。180 秒是短剧式的三分钟口径,漫剧行业更常见的是五分钟一集,所以下面每个数我都同时给了每分钟价,你按自己的集长乘就行。
| 段 | 用量 | 成本 |
|---|---|---|
| 拆分镜 | 2 万输入 + 5 千输出,GLM-5.3-Flash 促销价 | $0.0027 |
| 视频 | 180 秒 × $0.24/秒 | $43.20 |
| 音频 | Seedance 默认自带 | $0 |
| 合计 | 一次过,不抽卡 | $43.20 |
(GLM-5.3-Flash 这个价是促销价,2026-09-09 到期,之后回到牌价 $0.0055。差距从 1.5 万倍收窄到约 7,900 倍,本文结论一个字都不用改。)
视频那一行用的是 720p 文生视频的牌价 $0.24。写稿当天模型页对文生视频挂着 86 折,折后 $0.207,一集就是 $37.26。本文一律按牌价算,因为折扣有起止而牌价没有——你自己算的时候记得先看当天页面上那一栏。
调用次数也值得先知道:Seedance 2.5 单次接受 4 到 30 秒,所以 180 秒至少要拆成六次调用。这一代能一次直出 30 秒,上一代单次只有 15 秒、更长的叙事要靠多轮延长拼接,但这一代仍然是分段生成——镜头之间的人物和场景一致性得靠参考素材维持,上限是 30 张图 + 10 段视频 + 10 段音频,合计 50 个。
各家的每秒价差多少、怎么用字节自己的公式反推谁加了几倍,拆在Seedance 2.5 转售方加了几倍价。接入路径和主体要求在Seedance 2.5 怎么接入。
为什么剧本那段可以不用管?
因为它是视频段的一万五千分之一。
$43.20 ÷ $0.0027 ≈ 15,700。换个说法:你把文本模型换成贵十倍的,一集总账单从 43.20 涨到 43.23 美元。
这条结论比它看上去更有用,因为它直接否掉了一批常见的优化动作:
- 为省 token 而压缩分镜提示词——省下的是零头,代价是描述变糙、抽卡率上升,净亏。
- 在拆分镜环节反复比价文本模型——比的是小数点后第四位。
- 为剧本段单独做缓存优化——缓存折扣作用在一个本来就接近零的数上。
真正值得花在剧本段的力气不是省钱,是降抽卡率。 一句写得更准的镜头描述,如果能把「七条挑一条」变成「五条挑一条」,省下的是几十美元,比省 token 高三个数量级。提示词该怎么写、哪些词会触发错误的任务类型,在Seedance 2.5 上手。
抽卡率怎么把 43 变成 324?
因为你为每一条废片付的钱和成片一样多。
公开报道记录过这个数的两端。据《中国企业家》,此前生成两三条就能挑出一条可用素材,拥堵期往往要生成七八条才能挑出一条。把这两端代进去:
| 抽卡率 | 一集三分钟 720p | 折人民币 | 每分钟 |
|---|---|---|---|
| 一次过(理论值) | $43.20 | ¥307 | ¥102 |
| 2.5 条挑 1 | $108.00 | ¥767 | ¥256 |
| 7.5 条挑 1 | $324.00 | ¥2,300 | ¥767 |
人民币按 1 美元 ≈ 7.1 元换算,只为和国内报价对得上号,汇率自己按当天的调。
单价一分没动,账单差了 7.5 倍。 这就是为什么只盯着每秒单价选供应商是错的——我们把这笔账单独算过一遍,见AI 视频 API 一秒多少钱。抽卡率为什么会突然变差、「降智」跟它什么关系,在Seedance 满血 API 还要白名单吗。
顺带说一件多数人不问的事:失败的生成计不计费。在七条挑一条的产线上,这一项对总账的影响远大于每秒差一两分钱。字节自己的文档写明只对成功生成的视频收费,其他路子得你自己问清楚并要书面答复。
工作室说一集几百块,为什么这里算出两千三?
因为两个数算的不是同一个东西。
漫剧行业的公开口径比上面这张表低一个量级。广电头条《视听快评》2026-01-25 的一份成本拆解写着:AI 介入后漫剧单分钟成本可降至 200-400 元,头部团队甚至能把单集(5 分钟)成本控制在 500 元以内。而本文抽 7.5 次算出来的是每集 ¥2,300。
差得离谱,但把那 500 元拆开,差的不是价格,是产品。同一份拆解给了五个环节的分配:
| 环节 | 单集成本 | 钱主要花在哪 |
|---|---|---|
| 脚本与分镜 | 50-80 元 | AI 生成加人工微调 |
| 画面生成 | 120-180 元 | 外包人工微调 100-160 元;AI 出图「30 张画面费用 15 元」 |
| 动态化处理 | 30-50 元 | 口型驱动 10-20 元,短片段生成 20-30 元 |
| 配音与音效 | 20-40 元 | AI 配音,单分钟 0.5-2 元 |
| 剪辑与包装 | 80-120 元 | 外包兼职 70-110 元 |
这张表里真正用于生成视频的,是 20-30 元。 原文写得很直接:动态化处理优先采用「静态画面 + 轻微运镜」模式以减少动态生成成本,复杂动作才通过 Runway、Pika 这类工具生成短片段、按帧计费。也就是说,行业口径里的一集漫剧是三十来张静态画面配上口型和轻微运镜,不是五分钟连续生成的镜头。
平台费也不在一个计费面上。同一份拆解里,即梦、可灵这类国内平台记的是「月费 50-100 元,平摊至单集约 3-5 元」——那是会员订阅摊销,不是按输出秒结算。
所以两个数都没错,它们回答的是不同的问题:
| 行业 500 元/集 | 本文 ¥2,300/集 | |
|---|---|---|
| 成片形态 | 静态画面 + 口型 + 轻微运镜 | 连续生成的运动镜头 |
| 花在视频生成上 | 20-30 元 | 几乎全部 |
| 最大开销 | 人力外包(画面微调、剪辑、配音) | 废掉的那几条 |
| 计费面 | 会员月费摊销 | API 按输出秒 |
| 集长 | 5 分钟 | 3 分钟 |
换算成每分钟最好比。 本文一次过是每分钟 ¥102,比行业 200-400 元/分钟的下沿还低;抽 2.5 次是 ¥256,落进区间;抽 7.5 次是 ¥767,冲出去接近一倍。把账推出行业区间的是抽卡率,不是单价——这和上一节是同一个结论,只是换了把尺子量。
那什么时候非走 API 不可?两种情况,都不是因为便宜。
- 你要的就是连续运动镜头。 静态图加运镜做不出来的东西,那 20-30 元的口径直接失效,得按本文这套算。
- 产能撞了天花板。 会员套餐的额度和排队是按账号给的,日更五到八集卡住的是并发不是钱包。拥堵期的公开记录难看到什么程度,在Seedance 满血 API 还要白名单吗里有——有创作者称提交后前面还有 8 万人排队。
反过来也说清楚:如果你做的就是静态图加口型那种漫剧,本文这套账不适合你,去照着那份 500 元拆解排预算更实在,这里的每一个数都会把你吓着。
先出 480p 再定稿,能省多少?
约四成,而且不需要改任何代码。
做法很直白:所有抽卡都在 480p 跑,只有选中的镜头再用 720p 重出一遍。
| 打法 | 算式 | 成本 |
|---|---|---|
| 全程 720p,抽 7.5 次 | 180 × $0.24 × 7.5 | $324.00 |
| 480p 打样 7.5 次 | 180 × $0.11 × 7.5 | $148.50 |
| 通过的镜头 720p 定稿 1 次 | 180 × $0.24 × 1 | $43.20 |
| 两段式合计 | 148.50 + 43.20 | $191.70 |
省下 40.8%,全部来自一件事:那 6.5 条废片不该按成片分辨率付钱。
两个前提要说清楚。一是 480p 的构图和运镜足以让你判断这条要不要,如果你的评判标准依赖细节质感,这套打法不成立。二是同一提示词在两个分辨率上不保证给出同一个镜头,所以定稿那一次仍可能翻车——把它算进你的抽卡率里,别按 1.0 记。
1080p 那一档还有个时间窗口:字节自家控制台的 1080p 促销到 2026-09-17 14:00(UTC+8)为止,那之前直连比走网关便宜。要出 1080p 成片的,接入那篇里有逐条对照。
这条链最容易断在哪?
三处,都不是模型能力问题。
- 任务类型判错。 Seedance 2.5 从提示词里的词推断你要做什么。一条编辑请求缺了触发词,会被当成参考生视频,返回一条画面没毛病但答非所问的片子——照样计费,而且它不会报错,你得自己看出来。
- 并发口径。 Ofox 的公开口径是每分钟 100 次请求、token 每分钟不限,而且 RPM 按团队累计,同一团队多开 key 不会提高吞吐。一集六次调用看着不多,批量跑十集就撞线了。超限返回 429,按响应头里的 reset 值做指数退避加抖动。
- 异步轮询的等待方差。 建任务返回得很快,成片要等多久是另一回事,同一任务两次跑出来的差距可能很大。拥堵期它会放大成排产问题——国内最早入局短剧赛道的资深编剧之一彭雨虹,带团队做 Seedance 2.0 时对《中国企业家》说:「白天服务器特别拥挤,只有晚上 8 点之后,尤其是凌晨时段,才会顺畅一些。」批量跑之前先量一下你自己所在时段的方差。实测口径在视频生成 API 返回 202 后要等多久。
最后回到那个 1.5 万倍。这条链上的成本几乎全部集中在一段,而那一段的成本又几乎全部由一个你自己才能测出来的数决定——抽卡率。没有任何一方公布过它,也没有任何供应商能替你降。在你自己的日志里量出这个数之前,任何成本测算都是估的。
整条流水线端到端跑通的实例在AI 视频 API 全自动做 YouTube Shorts,按场景选型的口径在视频生成 API 怎么选,两代之间的差别在Seedance 2.5 对比 2.0。价格与规格随时会变,落地前请以 Ofox 的 Seedance 2.5 模型页和 API 实时返回为准。
参考信息来源
常见问题
- 小说改成片,一集三分钟要花多少钱
- 按公开价,一次过是 43.20 美元:180 秒 720p 视频,每输出秒 0.24 美元。但没人一次过。按公开报道记录的抽卡率,好的时候两三条挑一条,拥堵期七八条挑一条,同一集的真实成本落在 108 到 324 美元之间,按 1 美元 ≈ 7.1 元是 ¥767 到 ¥2,300。拆分镜那段大约 0.0027 美元,音频不用单独做——Seedance 2.5 默认输出就带同步音频。
- 拆分镜用哪个模型更省钱
- 这个问题不值得花时间。一集三分钟的分镜脚本按 2 万输入加 5 千输出估,走 GLM-5.3-Flash 促销价是 0.0027 美元,而同一集的视频段是 43.20 美元,差约 1.5 万倍。该促销 2026-09-09 到期,之后剧本段翻倍到 0.0055 美元、差距收窄到约 7,900 倍,结论不变。就算你把文本模型换成贵十倍的,总账单也只多三分钱。所有省钱空间都在视频那一段和抽卡率上。
- 漫剧工作室说单集几百块,为什么这里算出两千多
- 因为算的不是同一个东西。广电头条《视听快评》2026-01-25 的成本拆解里,单集(5 分钟)500 元的漫剧,真正用于生成视频的只有 20-30 元——因为那种成片是三十来张静态画面配口型和轻微运镜,不是连续生成的镜头;大头是外包人力(画面微调 100-160 元、剪辑 70-110 元),即梦、可灵这类平台记的是月费 50-100 元摊到单集 3-5 元,不是按输出秒结算。本文算的是全程连续生成,按每分钟比:一次过 ¥102,低于行业 200-400 元/分钟的下沿;抽 7.5 次 ¥767,才冲出区间。把账推高的是抽卡率不是单价。
- 先出 480p 再定稿能省多少
- 按拥堵期七八条挑一条算,能省约四成。全程 720p 抽 7.5 次是 324 美元;草稿全部走 480p(每秒 0.11 美元)抽 7.5 次是 148.50 美元,通过的镜头再用 720p 出一遍 43.20 美元,合计 191.70 美元(约 ¥1,361)。省下的 40.8% 完全来自「废掉的那 6.5 条不该按成片分辨率付钱」。
- 这条链最容易断在哪
- 三处。一是任务类型判错:Seedance 2.5 从提示词里的词推断做什么,编辑请求缺了触发词会返回一条没毛病但答非所问的片子,照样计费。二是并发口径:Ofox 是每分钟 100 次请求且按团队累计,多开 key 不提高吞吐。三是失败计不计费,这一项在抽卡率高的产线上比每秒差几分钱重要得多。


