fal、Replicate、Ofox 视频 API 价格实测(2026)

同一个 Seedance 2.0 跑 1080p:Ofox $0.34/s vs fal $0.682/s,差不多一半。Wan 2.6/2.7 两家一致。2000 条月账单,逐个分辨率算给你看。

fal、Replicate、Ofox 视频 API 价格实测(2026)

摘要: 三家视频 API,三种计费模型,一个问题:真上量的时候谁最便宜。这个答案只有在模型和分辨率对齐时才有意义。Seedance 2.0 跑 1080p,Ofox 计费 $0.34/s(每条 5 秒片 $1.70),对上 fal 带音频的 $0.682/s($3.41),所以 Ofox 差不多是一半;Wan 2.6 和 2.7 上两家完全一致(720p $0.10/s、1080p $0.15/s)。fal 只在更低档才赢,比如 Wan 2.5 的 $0.05/s(480p)或上一代 Seedance 1 Pro,而 Replicate 官方的每秒视频价更高(Wan 2.1 720p $0.25/s)。Ofox 的每个价都是 480p 的「起步」下限,随分辨率往上跳。一个不带模型版本和分辨率的每秒数字,不是你能拿来做决策的价格。

到底该选哪个?

如果你要规模化跑最新的 Seedance 或 Wan,在模型和分辨率对齐的前提下 Ofox 是最便宜的锚点:同一个 Seedance 2.0 跑 1080p,成本差不多是 fal 的一半,而 Wan 2.6/2.7 两家一模一样。fal 只在它把某个较低档定得很便宜的模型上赢(Wan 2.5 的 $0.05/s,480p),或者赢在 Ofox 不托管的一方自有模型上(Kling、Veo、Sora)。Replicate 官方的每秒视频模型价更高,而它的硬件按秒轨道是这里的异类:对你自己部署的定制或开放权重模型很强,但很难预估,因为你为渲染时间付费,而不是输出秒数。它还上架了一条老 Seedance lite 线,比谁都便宜,代价是上一代的画质。

场景选谁为什么
上量跑最新 Seedance / Wan,账单要可预测Ofox按输出秒、分辨率分档计费(Seedance 2.0 从 480p 的 $0.07/s 到 1080p 的 $0.34/s),一个端点
预算紧、只要 480p 草稿falWan 2.5 的 $0.05/s(仅 480p)是本次对比里最便宜的价
你自己部署的定制或开放权重模型Replicate硬件按秒计费,完全掌控模型
想在同一个账户里连带跑 Kling / Veo / Sorafal一方自有模型目录很广,Ofox 不托管
一把 key 跑 Seedance + Wan,不用在多个控制台间来回切Ofox一把 key、POST /v1/videos、按秒计费
需要在跑之前就能预估成本Ofox按输出秒计费,没有空闲或硬件的意外

下面全是那张表背后的算术:每个平台本周从自家页面拉到的真实价格、同一份工作量用三种方式跑出的 2000 条月账单,以及那些让「便宜」的每秒价骗到你的坑。

快速规格对比

三个平台给视频定价的方式并不一样,这正是为什么天真地「按秒」对比会误导人。Ofox 是按输出秒、分辨率分档。fal 是按模型来,有时按秒、有时按整条视频、有时按 token。Replicate 有两条完全独立的计费轨道。下面是各家的形态,数字取自各家 2026-07-20 的实时页面。

维度OfoxfalReplicate
主计费单位输出秒,按分辨率分档按模型:秒、整条视频或 token硬件秒,或官方模型的输出秒
Seedance 价格bytedance/seedance-2.0 $0.07/s(480p)→ $0.34/s(1080p)Seedance 2.0 $0.3034/s(720p)/ $0.682/s(1080p),带音频;Seedance 1 Pro 约 $0.124/s官方 Seedance 按秒托管(老 lite 从约 $0.018/s 起)
Wan 价格alibaba/wan-2.6 / wan-2.7 $0.10/s(720p)/ $0.15/s(1080p)Wan 2.6/2.7 同为 $0.10–$0.15/s;Wan 2.5 从 $0.05/s 起(480p)wan-2.1-i2v-720p $0.25/s,480p $0.09/s
上架的最便宜视频档Seedance 2.0 Mini $0.04/s(480p)Wan 2.5 $0.05/s(480p)老 Seedance lite 约 $0.018/s
空闲 / 启动计费标准运行无公开模型:无。私有/部署:有
端点模型一把 key,POST /v1/videos一把 key,按模型定结构一把 key,按模型定结构
Kling / Veo / Sora不托管Kling 2.5 Turbo Pro $0.07/s,Veo 3 $0.50–$0.75/s托管,价格不一

从这张表能读出两件事。第一,在模型和分辨率对齐时,Ofox 是最便宜的当代选项:同一个 Seedance 2.0 跑 1080p 是 $0.34/s,对上 fal 的 $0.682/s,而 Wan 2.6/2.7 两家一样。第二,fal 那些低到显眼的标题数字买的是另一个档位,不是直接打折:Wan 2.5 的 $0.05/s 是 480p,Seedance 1 Pro 是上一代。Replicate 在这里挂着单看最便宜的原始每秒价,一条约 $0.018/s 的老 Seedance lite 线,但它当前的官方视频模型(Wan 2.1 720p $0.25/s)站在其他家之上,而它的硬件轨道完全是另一码事,下文详述。

Ofox 有一件事不做:它不托管 Kling 或 Hailuo。如果你的流水线专门押注 Kling,那 fal 才是你以 $0.07/s 拿到它的地方。这篇讲的是同等能力下的价格,不是说 Ofox 什么模型都有。

各平台实际怎么算钱

在做任何月账单之前,你得先明白「每秒」在这三个平台上是三种不同的东西。

Ofox 最好理解,但它的费率在各分辨率之间并非一口价。每个视频模型都按输出秒计费,目录上的那个数字是这个模型的最低「起步」价,也就是它的 480p 下限。bytedance/seedance-2.0 在 480p 是 $0.07/s、720p 是 $0.16/s、1080p 是 $0.34/s,所以一条 5 秒 1080p 片是 5 × $0.34 = $1.70。没有硬件栏、也没有空闲费,但你得看自己分辨率对应的档位,而不是标题下限。你提交到 POST /v1/videos,轮询到任务 completed,账单就是 时长 × 该分辨率的费率。同一个模型上,视频转视频的计费可能高于文本转视频。

fal 按模型计费,单位随模型而变。它的价格页写明计费是「按输出单位,每秒或每条视频,取决于模型」。有些模型是干净的按秒:Wan 2.5 $0.05/s(480p)、Wan 2.6/2.7 $0.10–$0.15/s、Kling 2.5 Turbo Pro $0.07/s、Veo 3 关音频 $0.50/s 或开音频 $0.75/s(Veo 3 Fast 是 $0.25–$0.40/s)。有些是按整条视频,比如 Ovi 每条 $0.20。Seedance 按百万视频 token 计价:fal 当前的 Seedance 2.0 换算下来是 720p $0.3034/s、1080p 带音频 $0.682/s,而更老的 Seedance 1 Pro 落在约 $0.124/s。在你读它的页面之前,你没法假设某个 fal 模型是按秒计价的,也没法假设它属于哪一代。

Replicate 有两条会坑到人的轨道。多数公开模型按硬件时间计费,也就是你为 GPU 运行的秒数付费,费率从小型 CPU 的 $0.000025/s(普通 CPU 是 $0.0001/s)一路到 H100 的 $0.001525/s。一条视频在 H100 上渲染要 90 秒,就是 90 × $0.001525 = $0.137 的 GPU 时间,但渲染时间是变量、跑之前很难预估。另外,Replicate 精选的 官方模型 像其他家一样按输出秒计费:wan-2.1-i2v-720p 是 $0.25/s,wan-2.1-i2v-480p 是 $0.09/s,它的官方 Seedance 线也是按秒,从一条老 lite 档的 $0.018/s 起,到当前模型(费率看各自的模型页)。公开模型你只为实际处理时间付费;私有模型和部署还会对启动和空闲时间计费。

三种视频 API 计费模型对比给一次视频生成计费的三种方式同一条 5 秒 1080p 片,三种计费思维模型Ofox按输出秒,分辨率分档时长 x 档位费率5s x $0.34/s = $1.70没有硬件栏没有空闲费$0.07 480p 下限,随分辨率跳跑之前就可预测账单 = 5 x $0.34 = $1.70fal按模型:秒、视频或 token读模型页单位随模型而变Wan 2.5:$0.05/s(480p)Kling 2.5 Turbo Pro:$0.07/sOvi:$0.20 / 整条视频Seedance 2.0:$0.682/s(1080p)账单 = 看是哪个模型Replicate硬件秒或输出秒两条轨道GPU 时间 或 输出秒H100:$0.001525/s 渲染官方:wan-2.1-720p $0.25/sSeedance lite 从 $0.018/s 起私有/部署:空闲也计费账单 = 渲染时间 或 $0.25/s

同一条 1080p 片,在 Ofox 上固定 $1.70,在 fal 上是按模型算的金额(Seedance 2.0 带音频 $3.41),在 Replicate 上要么是 GPU 渲染时间、要么是官方模型的每秒价。

同模型对比:Seedance

比价唯一诚实的方式,是把除平台外的一切都固定住。fal 和 Ofox 现在都托管 Seedance 2.0,所以它是最干净的同代锚点。拿一条 1080p、5 秒、带音频的片。

Ofox 跑 bytedance/seedance-2.0,1080p 是 $0.34/s,所以每条 5 × $0.34 = $1.70。fal 托管同一个 Seedance 2.0 代,按视频 token 计价,换算下来 1080p 带音频是 $0.682/s,或者每条约 5 × $0.682 = $3.41。在 720p 上规律照旧:Ofox 是 $0.16/s($0.80),对上 fal 的 $0.3034/s($1.52)。在对齐的 Seedance 2.0、同分辨率下,Ofox 大约是一半的价,1080p 是 $1.70 对 $3.41,720p 便宜约 47%。

一个诚实的补充,因为懂行的读者你不说他也会提:fal 仍然挂着上一代的 Seedance 1 Pro,约 $0.124/s(一条 1080p 5 秒片约 $0.62),比两家的 2.0 都便宜。如果那个老模型的画质过得了你这关,它就是本次对比里最低的 1080p Seedance 价。这个「一半」的说法特指同代,Seedance 2.0 对 Seedance 2.0。Replicate 也按秒托管官方 Seedance,从一条约 $0.018/s 的老 lite 档起;它当前的 Seedance 2.0 费率在模型页上,这里不钉死。

同模型对比:Wan

Wan 是平局,而且值得说清楚。fal 和 Ofox 都托管 Wan 2.6 和 2.7,费率相同:720p $0.10/s、1080p $0.15/s。这里价格不是区别所在;区别在于 Ofox 让 Wan 走的是和 Seedance 同一个单一端点和结构,而在 fal 上每个模型各带自己的结构。fal 也挂着更老的 Wan 2.5,带一个 $0.05/s 的下限,但那个下限是 480p;Wan 2.5 在 720p 是 $0.10/s、1080p 是 $0.15/s,和更新的版本一样。Replicate 官方的 wan-2.1-i2v-720p 是 $0.25/s、wan-2.1-i2v-480p 是 $0.09/s,是定价高于两家的更老一代 Wan。

平台Wan 模型费率分辨率
fal & OfoxWan 2.6 / 2.7$0.10/s · $0.15/s720p · 1080p
falWan 2.5$0.05/s · $0.10/s · $0.15/s480p · 720p · 1080p
Replicatewan-2.1-i2v-720p$0.25/s720p
Replicatewan-2.1-i2v-480p$0.09/s480p

唯一真便宜的数字是 fal 的 Wan 2.5 $0.05/s,它买的是 480p。到 720p 及以上,fal 和 Ofox 的 Wan 收费一样,于是选择就归结于:你想要 Wan 和 Seedance 走一个端点(Ofox),还是放进 fal 的按模型目录里。这个教训重复出现:一个不带版本和分辨率的每秒数字,不是你能拿来做决策的价格。

价格算术:真实月账单

每秒费率在你乘上真实用量之前都是抽象的。拿一个小型内容团队,每月生成 2000 条片、每条 5 秒,并按每个模型实际使用的分辨率给每个选项定价。这对一个搅动产品和促销变体的电商或社媒团队来说是个真实节奏。下面是同一份工作量在三个平台上的样子,每条单价都从费率推导而来。

平台模型(分辨率)费率每条 5s 片2000 条 / 月
falWan 2.5(480p)$0.05/s$0.25$500
OfoxSeedance 2.0 Mini(720p)$0.08/s$0.40$800
falSeedance 1 Pro(1080p)约 $0.124/s$0.62$1,240
fal & OfoxWan 2.6 / 2.7(1080p)$0.15/s$0.75$1,500
OfoxSeedance 2.0(720p)$0.16/s$0.80$1,600
Replicatewan-2.1-i2v-720p$0.25/s$1.25$2,500
falSeedance 2.0(720p,带音频)$0.3034/s$1.52$3,034
OfoxSeedance 2.0(1080p)$0.34/s$1.70$3,400
falSeedance 2.0(1080p,带音频)$0.682/s$3.41$6,820

月度视频账单:2000 条片、每条 5s,按分辨率对齐月账单:2000 条/月,每条 5s每项按其模型实际使用的分辨率定价$0$1,750$3,500$5,250$7,000$500falWan 2.5 480p$800OfoxSeedance Mini 720p$1,240falSeedance 1 Pro$1,500fal & OfoxWan 2.6/2.7 1080p$1,600OfoxSeedance 2.0 720p$2,500ReplicateWan 2.1 720p$3,034falSeedance 2.0 720p$3,400OfoxSeedance 2.0 1080p$6,820falSeedance 2.0 1080p橙 = Ofox · 灰 = fal / Replicate · 对齐的 Seedance 2.0 1080p:$3,400 vs $6,820

同样每月 2000 条片,每条按其模型实际使用的分辨率计。对齐的 Seedance 2.0 跑 1080p,Ofox $3,400 对 fal $6,820;Wan 2.6/2.7 平手在 $1,500。那些便宜的下限($500、$800)是 480p 或 Mini 档。

读这个分布要靠对齐模型,而不是扫哪个数字最小。两行 Seedance 2.0 才是同类对比:在 1080p,Ofox 是 每月 $3,400,对上 fal 的 $6,820,几乎正好一半,而在 720p 是 $1,600$3,034。Wan 2.6/2.7 是死平局,两家都是 $1,500。那些真便宜的离群值属于另一个档:fal 的 Wan 2.5 $500 是 480p,fal 更老的 Seedance 1 Pro $1,240 落后一代。Replicate 官方的 Wan 2.1 720p 线 $2,500 是图中最贵的当前每秒选项,不过它更老的 Seedance lite 档(约 $0.018/s,不在本图内)如果那画质过得了你这关,就比谁都便宜。

两个诚实的注脚。第一,Replicate 的硬件轨道没画进这张图,因为它按渲染时间计费、不是输出秒,所以一个快的开放权重模型跑在便宜 GPU 上,成本可能低于以上任何一个,代价是可预测性。第二,这里最便宜的原始费率属于更老或更低分辨率的模型(fal Wan 2.5 的 480p、Replicate 的 Seedance lite),不属于一条当代 1080p 片。能推广的结论不是「Ofox 永远赢」,而是「同一个当前 Seedance 2.0、同分辨率下,Ofox 差不多是 fal 的一半,Wan 平局,而除了 Replicate 的私有轨道,没人会拿空闲或硬件费给你惊喜」。

分辨率和时长:藏起来的乘数

一个每秒费率只是价格的一半。另一半是多少秒、什么分辨率,而平台和模型都在这两个维度里藏了乘数,把「便宜」的费率变成真实账单。

时长是线性的那个。这里每个模型都按秒计费,所以两个费率之间的差距会随片段长度直接放大。在对齐的 Seedance 2.0、1080p 下,Ofox 的 $0.34/s 对上 fal 的 $0.682/s 是每秒 $0.342 的差。在一条 5 秒片上是 $1.71;在一条 15 秒片(两家都支持的最长时长)上是每条 $5.13。每月生成几千条长片,这个差就成了财务会注意到的一条明细。短片藏住了模型选择;长片则把它暴露出来。如果你的格式偏长,就用你真实的时长去测和定价,别用一个安全的 5 秒样本,因为在 5 秒时看起来更便宜的那个,未必在 15 秒时也更便宜。

分辨率是人们忘掉的那个乘数,而在 Ofox 上它不是一口价。每秒费率在同一个模型内随分辨率往上跳:Seedance 2.0 是 $0.07(480p)→ $0.16(720p)→ $0.34(1080p)→ $1.37(4K),所以降一档分辨率就直接降账单,而目录的「起步」价永远是 480p 下限。你可以靠给旗舰降分辨率来省,也可以靠切到更便宜的档来省(Mini 从 $0.04/s 起,最高到 720p)。fal 按 token 计价的模型在构造上以同样方式缩放:Seedance 算 token 是 高 × 宽 × FPS × 时长 / 1024,所以一条 1080p 片比同长的 720p 片花更多 token。Replicate 把它拆到不同模型条目上,480p 的 Wan 模型是 $0.09/s、720p 的 Wan 模型是 $0.25/s,所以在 Replicate 上分辨率是一次模型选择,不是一个参数。

这条实用规则在三家都成立:按你的分发上限选分辨率,别按规格表上最高的那个数字。多数社媒分发都封顶在 1080p,因为 Instagram、TikTok 和 YouTube Shorts 会把更高的降采样,所以为了喂一条竖版故事去买 4K 就是烧钱。4K 值回成本的地方是会被重新剪辑的母版、会被裁切的 VFX 素材,以及客户要按全分辨率归档的交付件。把分辨率匹配到片子实际播放的地方,再选能过关的最便宜档位或模型,那个每秒费率才终于变成一个你能信的价格。

额度、最低消费与隐藏成本

费率卡是厂商打广告的那个数字。发票里包含费率卡上没有的东西,而两个「相似」的价格正是在那里分道扬镳。对视频来说,具体有四类要紧。

先从空闲和启动计费说起,这是最大的沉默乘数。Ofox 以及两个平台的公开模型都只对你生成的东西计费,没有空闲费。Replicate 的私有模型、部署和常驻端点会对启动和空闲时间计费,不只是活跃渲染秒。如果你为了砍冷启动延迟而立起一个私有部署,那它在等下一个请求时坐着的每一秒你都得付,在低流量流水线上这可能远超每条片的成本。Ofox 没有对应的一栏,因为根本没有实例要保温:你提交、它渲染、你为输出付费。在你假设「按量付费」等于「只在生成时付费」之前,先读任何厂商的细则。

附加功能是下一条要查的线。音频、口型同步和超分有时打包、有时另计。在 Ofox 的 Seedance 和 Wan 档上,同步音频包含在每秒费率里。在 fal 和 Replicate 上,音频行为按模型来:fal 上面那些 Seedance 2.0 费率就是开音频的数字,而 Veo 3 明确开音频($0.75/s)比关音频($0.50/s)收更多,所以在那些模型上音频是费率乘数、不是白送。如果你的流水线需要音频,就按开音频的费率定价、别按标题数字,而如果某个模型把口型同步作为单独端点提供,还要把那次调用的成本加进总额。

免费额度值得存疑。三家都提供某种形式的启动额度来试 API,也都会定期改这些条款。促销额度通常会过期,而视频的免费档上限很小,因为视频渲染很贵。把免费额度当成验证输出质量的方式,别当成真实预算里的一条成本线,并在你注册的那一周去各家自己的页面确认当前条款,而不是信一篇对比文里的数字,包括这篇。

最后是重试和失败。一次失败的生成还是在某处消耗了算力,而这怎么计费各家不同。在按输出秒计费下没有完成的输出可计,所以一个 failed 任务通常不花钱:在 Ofox 上,按其文档,用量只在完成的任务上记录,fal 按秒的模型也一样。Replicate 常被当成例外,但它的计费文档写得很直白,「对所有模型,如果一次运行失败,我们不收你钱」,所以在公开或官方模型上一次失败的运行在那里也是免费的。真正的例外是 Replicate 的私有模型和部署,它们不论结果如何都为实例活跃的时间计费(而取消一次官方模型运行仍可能产生费用)。如果你的提示词把模型能处理的边界往外推,按输出秒计费和 Replicate 的公开模型都能让你不为那些失手付费;只有一个常驻的私有部署会在失败中一直计费。

隐藏成本OfoxfalReplicate
空闲 / 启动时间无(标准)私有 / 部署会计费
音频包含在档位费率里按模型(Seedance 费率是开音频;Veo:开则加价)按模型
失败的生成不计费(按文档,用量只在完成的任务上记录)不计费公开/官方:不计费。私有/部署:实例时间仍计费
免费额度可靠性核实当前条款核实当前条款核实当前条款

能推广的点:计费维度最少的平台最好预估、也最难拿意外坑你。Ofox 有一个维度,按分辨率的输出秒。fal 有两个,按模型的单位加任何附加项。Replicate 最多,横跨硬件秒、输出秒、空闲和启动,这买来了灵活性,代价是可预测性。

Ofox 上的异步工作流

三个平台都异步生成视频,因为一条片要几秒到几分钟才渲染完,没人会把一条 HTTP 连接开那么久。在 Ofox 上流程走一个端点。POST /v1/videos 返回 202 Accepted 和一个 polling_url,片子在后台渲染,你要么轮询 GET /v1/videos/{id}statuscompleted,要么注册一个 callback_url webhook 等回调。

字段 / 状态含义怎么做
202 + polling_url任务已受理,尚未渲染存下 URL,开始轮询
status: pending / queued已受理,随后在上游排队——尚未渲染每 1–2s 继续轮询
status: in_progress在上游渲染中继续轮询
status: completed完成,附带结果 URL24 小时内取 unsigned_urls,或用持久的 mirror_urls
status: failed生成出错error,重试或降级
status: cancelled / expired终态,无输出产生停止轮询;若仍需要这条片就重新提交

因为 Ofox 按输出秒计费,渲染花 30 秒还是 3 分钟都不改变你的账单。这就是它和 Replicate 硬件轨道的实际区别——在那里,一次慢渲染跑在贵 GPU 上就更贵——也是为什么当你为输出而非算力付费时预估更容易。

通过 Ofox 一次试三家:一把 key、一个循环

把 Seedance 和 Wan 都路由过 Ofox 的意义在于,换模型只是一个端点上改一个字符串,于是你能 A/B 它们,而不用立起两套 SDK。下面用到的模型 ID 就是字面字符串:bytedance/seedance-2.0alibaba/wan-2.7

想在把流水线定死之前自己跑一遍数字?Ofox 按输出秒计费、一把 key 打通所有视频模型,所以一次 Seedance 对 Wan 的 A/B,搭起来的成本和只跑一个一样。

Python,在一个端点上提交两个模型

import os, time, requests

OFOX = "https://api.ofox.io/v1"
HEADERS = {"Authorization": f"Bearer {os.environ['OFOX_API_KEY']}"}

def generate(model, prompt, seconds=5, resolution="1080p"):
    r = requests.post(f"{OFOX}/videos", headers=HEADERS, json={
        "model": model,
        "prompt": prompt,
        "duration": seconds,
        "resolution": resolution,
        "aspect_ratio": "16:9",
    })
    r.raise_for_status()
    task = r.json()
    poll = task["polling_url"]
    while True:
        s = requests.get(poll, headers=HEADERS).json()
        if s["status"] in ("completed", "failed", "cancelled", "expired"):
            return s
        time.sleep(2)  # poll every ~2s

prompt = "A ceramic cup on a wooden table, morning light, steam rising."
for model in ("bytedance/seedance-2.0", "alibaba/wan-2.7"):
    out = generate(model, prompt)
    print(model, out["status"])  # cost is duration x per-second rate for that resolution

Node,同样的形态

const OFOX = "https://api.ofox.io/v1";
const H = { Authorization: `Bearer ${process.env.OFOX_API_KEY}`, "Content-Type": "application/json" };

async function generate(model, prompt, seconds = 5, resolution = "1080p") {
  const res = await fetch(`${OFOX}/videos`, {
    method: "POST",
    headers: H,
    body: JSON.stringify({ model, prompt, duration: seconds, resolution, aspect_ratio: "16:9" }),
  });
  const task = await res.json();
  while (true) {
    const s = await (await fetch(task.polling_url, { headers: H })).json();
    if (["completed", "failed", "cancelled", "expired"].includes(s.status)) return s;
    await new Promise((r) => setTimeout(r, 2000)); // ~2s between polls
  }
}

const prompt = "A ceramic cup on a wooden table, morning light, steam rising.";
for (const model of ["bytedance/seedance-2.0", "alibaba/wan-2.7"]) {
  const out = await generate(model, prompt);
  console.log(model, out.status); // one-string swap, same billing shape
}

两次运行之间唯一变的行就是模型字符串。在 fal 或 Replicate 上,同样一次 A/B 意味着两套不同的请求结构,而在 Replicate 上还可能是两条不同的计费轨道,所以「换一个字符串」这个属性专属于让两个模型都走一个 Ofox 端点。

什么时候选 fal

当它定得便宜的某个较低档正好是你真想要的模型,或者你需要一个 Ofox 不托管的一方自有模型时,选 fal。Wan 2.5 的 $0.05/s 是本次对比里最便宜的 Wan 系列费率,所以如果 480p 的 Wan 2.5 能过你这关,那这活儿 fal 直接赢。fal 也是 Kling 2.5 Turbo Pro($0.07/s)、Veo 3 和 Sora 的地方,这些 Ofox 不带。不过在两家都托管的模型上,fal 并不更便宜:Wan 2.6/2.7 一模一样,而 fal 的 Seedance 2.0 在对齐分辨率下差不多是 Ofox 的两倍。

坑在于 fal 的计费单位是按模型、不统一。有些模型按秒、有些按整条视频、有些按百万 token。你得在能预估账单之前读每个模型的页面,而像 Seedance 这样按 token 计价的模型还需要那套算例来换算成每条价。给读页的时间留出预算,不只是渲染时间。

什么时候选 Replicate

当你想跑一个自己部署的定制或开放权重模型、并且想掌控具体硬件时,选 Replicate。硬件按秒模型(从 H100 的 $0.001525/s 到小型 CPU 的 $0.000025/s)是这样的正确工具:你有一个微调版或一个没有任何网关托管为托管端点的冷门开放模型。对公开模型你只为实际处理付费,这让随手用保持便宜。

坑在于可预测性,以及在官方模型上的价格。硬件计费意味着你的成本取决于渲染时间,而渲染时间每次跑都不同,所以你没法像按输出秒计费那样报一个固定的每条价。Replicate 精选的官方视频模型确实按输出秒计费,但当前的 Wan 线在这里站得比其他家高(720p Wan $0.25/s);它也挂着一条约 $0.018/s 的老 Seedance lite 档,以上一代的画质压过所有人。如果你想要在当前 Seedance 或 Wan 上有一个托管的、可预估的每条成本,这是最难做到那件事的平台。

什么时候三家都不选(以及还有什么要紧)

如果你的片是 2 到 3 秒,Ofox Seedance 的 4 秒下限就把 Seedance 排除了,所以在优化费率之前,先把模型的最短时长匹配到你的格式。如果你被锁死在 Kling 上,Ofox 不托管它,那 fal 就是你的每秒 Kling 来源。而如果你整条流水线就是一个冷门的开放权重模型,一台裸 GPU 主机或 Replicate 的硬件轨道在成本上可能打败所有托管的每秒选项,代价是自己做运维。

对其他所有要规模化跑当代 Seedance 或 Wan 的人来说,决策大多是关于你需要账单有多可预测。Ofox 上的按输出秒计费给你一个能在跑之前就填进表格的数字。那才是区别所在,比价目表里的任何单独一行都更重要。

想更深入了解各个模型和更大的格局,可以看 Seedance 2.0 对比 Wan 视频 APISeedance 2.0 Fast 与 Mini 档位对比Sora、Veo、Kling 视频 API 横评Kling 2.6 Pro 视频 API 指南,以及 Veo 3.1 Google 视频 API 教程。非视频的模型费率,可以看 AI API 价格对比,涵盖文本和多模态模型。

FAQ

下面的 FAQ 回答了视频 API 价格在「大家还在问」里出现最多的问题。完整答案在页面的结构化数据里。

本次更新核对过的来源

  • fal.ai 价格页:https://fal.ai/pricing
  • fal.ai Seedance 2.0 模型页:https://fal.ai/models/bytedance/seedance-2.0/text-to-video
  • fal.ai Seedance 1 Pro 模型页:https://fal.ai/models/fal-ai/bytedance/seedance/v1/pro/text-to-video
  • fal.ai Wan 2.6 / 2.7 模型页:https://fal.ai/models/wan/v2.6/text-to-videohttps://fal.ai/models/fal-ai/wan/v2.7/text-to-video
  • fal.ai Kling 2.5 Turbo Pro 模型页:https://fal.ai/models/fal-ai/kling-video/v2.5-turbo/pro/image-to-video
  • Replicate 价格页:https://replicate.com/pricing
  • Replicate 计费文档:https://replicate.com/docs/topics/billing
  • Replicate Wan 2.1 i2v 720p 模型:https://replicate.com/wavespeedai/wan-2.1-i2v-720p
  • Replicate 官方 ByteDance / Seedance 模型:https://replicate.com/bytedance
  • Ofox Seedance 2.0 模型页
  • Ofox Wan 2.7 模型页
  • Ofox 视频 API 文档:https://ofox.io/docs/api/videos
  • ByteDance Seed 的 Seedance 页
  • Wan 项目站点