fal.ai 替代方案(2026):6 个视频 API 按每秒成本横评
按真实每秒成本盘 fal.ai 视频替代方案:同一 Seedance 2.0 在 1080p 只要 $0.34/s,fal 却要 $0.68/s,另含 Replicate 与自托管,一把密钥全搞定。
摘要: fal.ai 胜在模型目录够广,但它按模型逐个计价,藏着两个坑:标称价往往买到的是低档位,而同一个模型的价格可能是统一费率供应商的两倍。同样是 1080p 的 Seedance 2.0,OpenAI 兼容网关(ofox.ai)收 $0.34/s(5 秒片段 $1.70),fal 带音频要 $0.682/s($3.41),差不多贵一倍。要自己跑开源权重模型,Replicate 的硬件计费更划算。要用 Runway、Veo 这类西方自研模型,直接找厂商才是绕开 fal 转售的正解。本文只用一个真正重要的数字给六个替代方案排序:同一模型、同一分辨率下的成本。
fal 替代方案怎么选?
按你实际生成什么来选,别看谁的目录最大。fal 赢在广度,一个账号就能碰到 Veo、Kling、Hailuo、Pika 和 Seedance。但广度不等于便宜,对于多数团队真正上量的那几个模型,存在更便宜也更可预测的路径。
| 场景 | 选择 | 原因 |
|---|---|---|
| 当代 Seedance / Wan 上量,账单要可预测 | Ofox(网关) | 按分辨率的每输出秒计费,一把密钥,同款 Seedance 2.0 约为 fal 一半的价 |
| 自部署的开源权重或自定义模型 | Replicate | 按硬件秒计费,完全掌控模型,公共模型跑失败不收费 |
| 你明确要 Runway 或 Veo,而非中国模型 | 直连厂商 | 跳过转售加价,直接找 Runway、Luma 或 Google 的 Gemini API |
| 你要的就是 Hailuo,且想要源头 | MiniMax 直连 | 官方国际平台,但套餐起充门槛偏高 |
| 视频加文本、图像模型共用一把密钥 | Ofox(网关) | Seedance、Wan 和大模型都在同一个 OpenAI 兼容端点上 |
| 追求绝对最低成本、无单片费用,自己扛运维 | 自托管 Wan | 开源权重跑自己的 GPU,零每秒加价 |
本文后面就是这张表背后的证据:人们为何离开 fal、每个替代方案怎么计费、同款模型的价格算账,以及切换用的代码。
开发者为什么找 fal 的替代方案
fal 把一大堆视频模型放进一套干净的 API,这件事它做得确实好。会去别处看的理由很窄、很具体,而且全都落在它怎么定价上。
| 离开的理由 | 意味着什么 | 替代方案在哪帮上忙 |
|---|---|---|
| 逐模型的计费单位 | 有的按秒计费,有的按整段视频,Seedance 按百万 token | 统一按每输出秒计费的供应商让账单可预测 |
| 同一模型,价更高 | fal 上 1080p 的 Seedance 2.0 带音频约 $0.68/s | 网关同款模型只收 $0.34/s |
| 标称价是上一代产品 | $0.05/s 的 Wan 2.5 是 480p 的上一代权重,不是当代 Wan 2.7 的折扣 | 对齐模型版本,别只看单价 |
| 自研模型的转售加价 | Veo、Runway 等都是经 fal 转售 | 直连厂商去掉中间层 |
| 只管视频的账号 | fal 是媒体 API,和你的大模型栈是分开的 | 网关把视频和文本放到一把密钥上 |
这些都不说明 fal 有错。它们只是说明:对一个大量上量当代 Seedance 或 Wan、或者想要一份账单管所有的团队来说,fal 不该是默认选择。本文正是围绕这个场景展开的。
速览:6 个替代方案一览
下面凡是给出每秒单价的地方都对齐了分辨率,数据来自 2026 年 7 月各厂商的实时定价页。不带分辨率的单价没有可比性。
| 替代方案 | 主计费单位 | 当代视频最低价 | 有中国模型吗? | 注册门槛 |
|---|---|---|---|---|
| Ofox(OpenAI 兼容网关) | 输出秒,按分辨率分档 | Seedance 2.0 Mini $0.04/s(480p) | Seedance、Wan、HappyHorse | 一把密钥,绑卡,按量付费 |
| Replicate | 硬件秒,官方模型则按输出秒 | 官方视频约 $0.09/s(480p) | Kling、Wan、Seedance、Hailuo | 一把密钥,绑卡,按量付费 |
| MiniMax / Hailuo(直连) | 每片段按预付视频点数 | Hailuo-02 512p/6s 约 $0.07/片 | 原生(Hailuo 就是 MiniMax) | 国际平台,套餐起充高 |
| Runway(直连) | 积分,按输出秒 | 看当前 Gen-4 套餐 | 无,西方自研模型 | 开户,绑卡,套餐分档 |
| Google Veo(经 Gemini API 直连) | 按输出秒 | 看当前 Veo 档位 | 无,西方自研模型 | Google Cloud / Gemini API 密钥 |
| 自托管 Wan(开源权重) | 你的 GPU 时间 | 电费加一块 GPU | Wan 是开源权重(阿里) | 运维你自己扛 |
这张表能读出两点。第一,唯一拥有干净、低、当代每秒单价的替代方案,是网关和 Replicate 的官方模型。第二,直连厂商的路径(Runway、Veo、MiniMax)是用一层转售加价去换它自己的接入流程,只有当你需要的正是那个特定模型时才值得。
各替代方案怎么计费(以及 fal 在哪扎人)
「每秒」在这些平台上至少有四种不同含义,这正是随手一比就会被误导的根源。
Ofox 按输出秒计费,随分辨率分档。目录上标的价是模型的 480p 起价。Seedance 2.0 在 480p 是 $0.07/s,720p $0.16/s,1080p $0.34/s,4K $1.37/s,所以一段 5 秒的 1080p 片段就是 5 × $0.34 = $1.70。Wan 2.7 在 720p 是 $0.10/s,1080p $0.15/s。没有硬件计费行,也没有闲置费。你向 POST /v1/videos 提交任务,轮询到状态变 completed,账单就是 duration × 该分辨率的单价。因为 Seedance、Wan 和你的文本模型都在同一把密钥后面,视频接入的是同一条代码路径、同一张账单。
fal 按模型逐个计费,单位并不统一。它的定价页写明按「输出单位计费,视模型而定按秒或按段」。有些是干净的按秒:Wan 2.5 是 $0.05/s(480p)、$0.10/s(720p)、$0.15/s(1080p),Veo 3 关音频 $0.50/s、开音频 $0.75/s,Veo 3.1 便宜些,$0.20/s 到 $0.40/s。另一些按整段视频。Seedance 按百万视频 token 计价,换算下来 720p 约 $0.3034/s,1080p 带音频约 $0.682/s,而更老的 Seedance 1 Pro 落在 $0.124/s 附近。不打开某个模型的页面,你没法假设它是按秒计费,也没法知道它是哪一代。
Replicate 有两条计费轨道,常让人踩坑。多数公共模型按硬件时间计费:你为 GPU 运行的秒数付钱,T4 是 $0.000225/s,H100 是 $0.001525/s。在 H100 上跑 90 秒的一次渲染,GPU 时间成本是 90 × $0.001525 = $0.137,但渲染时间是可变的,跑之前很难预测。另一条轨道上,Replicate 精选的官方模型和其他家一样按输出秒计费,480p 约 $0.09/s,720p 约 $0.25/s,它还列了一条更老的 Seedance lite 线,低至 $0.018/s。公共模型跑失败不收费;私有模型和部署则连启动、闲置时间也要计费。
MiniMax / Hailuo 直连按预付视频点数计费。一段 768p、6 秒的 Hailuo 2.3 片段是 1 点,1080p、6 秒是 2 点,便宜的 Hailuo-02 512p 档是 0.3 点。点数套餐大约每点 $0.224 到 $0.266,所以那段旗舰片段约 $0.22 到 $0.27。坑在于公示的套餐起充要几千美元,所以下单前先确认当下小额按量付费的条款。
同一段片段在网关上固定 $1.70,在 fal 上带音频要 $3.41。这个差距不是折扣,而是同一个模型被标了两种价。
同款模型,不同账单:Seedance 与 Wan 跨平台对比
因为 Seedance 2.0 和 Wan 在 fal、Replicate 和网关上都有,它们是最公平的试金石。固定模型和分辨率,再看单价。
| 模型、分辨率 | Ofox | fal | Replicate |
|---|---|---|---|
| Seedance 2.0,480p | $0.07/s | 按 token,更高 | 官方按秒 |
| Seedance 2.0,1080p | $0.34/s | 约 $0.682/s(带音频) | 官方,见模型页 |
| Seedance 2.0 Mini,480p | $0.04/s | (非同档位) | 更老的 lite 约 $0.018/s(上一代) |
| Wan 2.7(当代),720p | $0.10/s | $0.10/s | wan-2.1 720p $0.25/s |
| Wan 2.7(当代),1080p | $0.15/s | $0.15/s | 见模型页 |
| Wan 2.5(上一代),480p | (未上架) | $0.05/s | $0.09/s(wan-2.1 480p) |
仔细读。在最新的 Seedance 上,网关约为 fal 一半的价。在当代 Wan 2.7 上两者完全一致,所以没理由为了同一个数字去承受逐模型计价的复杂。fal 只在更老的产品上显得便宜:$0.05/s 的 Wan 2.5 是标在 480p 的上一代,它自己的 1080p 档也是 $0.15/s,和当代 Wan 2.7 一样。Seedance 1 Pro 同样是上一代。Replicate 官方按秒的视频在当代模型上比这两家都高,而它唯一那个最低裸价,即约 $0.018/s 的老 Seedance lite 线,是去年的画质。
价格算账:真实的一个月 2,000 段片段
单价在你把它乘起来之前都是抽象的。假设一个小内容团队每月渲染 2,000 段片段,每段 5 秒、1080p,用 Seedance 2.0。那就是 10,000 输出秒。
| 供应商 | 单价(Seedance 2.0,1080p) | 月账单 | 对比网关 |
|---|---|---|---|
| Ofox | $0.34/s | $3,400 | 基准 |
| fal(开音频) | $0.682/s | $6,820 | +$3,420(2.0 倍) |
| fal(关音频,按页估) | 看模型页 | 不定 | 查当前值 |
| 在 Ofox 上降到 Seedance 2.0 Mini(720p) | $0.08/s | $800 | 草稿档路由 |
重点不是某个数字永远最低。重点是:在完全相同的模型和分辨率下,逐模型的加价大致把账单翻倍;而把草稿和大批量渲染切到更便宜的档位(720p 的 Mini),能在不离开这个端点的前提下把账单再砍掉好几倍。正是可预测的按秒计费,让这个路由决策变成一行改动,而不是第二次集成。
六个替代方案,逐个拆
1. Ofox,OpenAI 兼容网关
最适合大量上量当代 Seedance 或 Wan、且想要一份可预测账单的团队。一把密钥就能拿到 Seedance 2.0、它的 Mini 和 Fast 档,以及 Wan 2.7,按分辨率的每输出秒计费,和你的文本、图像模型在同一个端点上。它不托管 Kling、Veo 或 Sora,所以如果你的流水线就依赖这些特定自研模型,它不合适。对于它确实收录的模型,它是本次对比里最便宜的当代锚点。
2. Replicate
最适合你想自己部署、自己掌控的开源权重或自定义模型。它的硬件按秒轨道让你跑任何能容器化的模型,只为 GPU 渲染时间付费,对某个冷门开源权重模型,这能胜过所有托管的按秒方案,代价是运维得你自己做。它精选的官方模型和别家一样按输出秒计费。公共模型跑失败免费,这在你反复调 prompt 时很重要。取舍在于预测:硬件轨道上你付的是渲染时间而非输出秒,所以慢的模型账单更大。
3. MiniMax / Hailuo,直连
最适合你要的正是 Hailuo、且想从源头拿的情况。MiniMax 有一个国际平台 platform.minimax.io,和它的中国控制台是分开的,海外开发者可用邮箱或 OAuth 注册直连。计费是预付视频点数,约每点 $0.22 到 $0.27,一段 Hailuo 2.3 768p/6s 片段是 1 点。门槛在于公示的套餐起充要几千美元,所以它更适合有真实用量的团队,而不是只想测一次渲染的人。若你只想便宜地试试 Hailuo,它在 fal 和 Replicate 上也有转售。
4. Runway 与 Luma,直连
最适合你需要的是西方自研模型,比如 Runway 的 Gen-4 线或 Luma 的 Ray,而非中国模型。两家都跑自己的 API,按积分、按输出秒计费,也都在 fal 上被转售。这里替代 fal 的做法就是直连去掉转售层,只有当那个特定模型就是你的流水线、且你的用量大到会在意加价时才值得。价格请以各厂商当前的套餐页为准,因为积分兑美元的比率和套餐分档比统一的按秒表变得更频繁。
5. Google Veo,经 Gemini API 直连
最适合你要的模型是 Veo,且你宁可和 Google 直接维系关系而不是通过转售商。Veo 3 和 3.1 可经 Google 的 Gemini API 和 Vertex AI 使用,按输出秒计费,它们在 fal 上也有(Veo 3 是 $0.50 到 $0.75/s,Veo 3.1 便宜些,$0.20 到 $0.40/s)。直连意味着面对一个 Google Cloud 项目及其访问规则,而不是一个媒体聚合器,所以这个决策是关于你想要哪种计费关系和配额模型,而不是模型本身。
6. 自托管开源权重 Wan
最适合完全不想要单片费用、又有运维预算的团队。阿里的 Wan 系列是开源权重,你可以在自己的或租来的 GPU 上跑,只为算力付费。在高用量下,这是单片边际成本的下限,也是运维工作量的上限:服务栈、队列、重试都归你,GPU 账单不管在渲染还是闲置都归你。对多数团队,直到用量非常高之前,托管的按秒方案在总拥有成本上都更划算。
什么时候该留在 fal
fal 常常就是对的答案,这话得直说。如果你的流水线需要在一个账号下拥有最广的自研模型目录,Veo、Kling、Hailuo、Pika、Seedance 一网打尽而不用对接五个厂商,fal 生来就是干这个的。如果你被锁定在 Kling 上,网关不托管它,那 fal 或 Replicate 就是你的来源。而 Pika 干脆没有自研 API:它自己的文档把 API 用户指向 fal,所以 fal 实际上就是 Pika 的 API。广度和自研覆盖是留下的真实理由。单个高用量模型上的价格,则是离开的理由。
用 Ofox 试一遍最便宜的当代路径
如果你实际发布的模型是 Seedance 或 Wan,切换很小。同一个 OpenAI SDK,换一个 base_url,加上视频模型 ID。你提交一个任务,然后轮询到它变 completed。
Python:在一个端点上提交 Seedance 任务
import os, time, requests
OFOX = "https://api.ofox.ai/v1"
KEY = os.environ["OFOX_API_KEY"]
HEADERS = {"Authorization": f"Bearer {KEY}", "Content-Type": "application/json"}
def render(model: str, prompt: str, resolution: str = "1080p", seconds: int = 5) -> str:
# 提交任务
r = requests.post(f"{OFOX}/videos", headers=HEADERS, json={
"model": model, # 在这里换档位,其余不变
"prompt": prompt,
"duration": seconds,
"resolution": resolution,
})
job_id = r.json()["id"]
# 轮询到终态(completed / failed / cancelled / expired)
while True:
s = requests.get(f"{OFOX}/videos/{job_id}", headers=HEADERS).json()
if s["status"] in ("completed", "failed", "cancelled", "expired"):
break
time.sleep(2)
if s["status"] != "completed":
return s["status"]
# 完成的任务返回 unsigned_urls(24 小时 TTL);若有 mirror_urls 则长期有效
return (s.get("unsigned_urls") or s.get("mirror_urls") or [None])[0]
# 用 Mini 出草稿($0.04/s 起),用旗舰渲染最终版
draft = render("bytedance/seedance-2.0-mini", "a paper boat on a rain-slick street, neon reflections", "720p")
final = render("bytedance/seedance-2.0", "a paper boat on a rain-slick street, neon reflections", "1080p")
print(draft, final)
Node:同样的写法
const OFOX = "https://api.ofox.ai/v1";
const HEADERS = {
Authorization: `Bearer ${process.env.OFOX_API_KEY}`,
"Content-Type": "application/json",
};
async function render(model, prompt, resolution = "1080p", seconds = 5) {
const r = await fetch(`${OFOX}/videos`, {
method: "POST",
headers: HEADERS,
body: JSON.stringify({ model, prompt, duration: seconds, resolution }),
});
const { id } = await r.json();
// 轮询到终态
while (true) {
const s = await (await fetch(`${OFOX}/videos/${id}`, { headers: HEADERS })).json();
if (["completed", "failed", "cancelled", "expired"].includes(s.status)) {
if (s.status !== "completed") return s.status;
// 完成的任务返回 unsigned_urls(24 小时 TTL);若有 mirror_urls 则长期有效
return (s.unsigned_urls || s.mirror_urls || [])[0] || s.status;
}
await new Promise((r) => setTimeout(r, 2000));
}
}
// 一个字符串切换档位:bytedance/seedance-2.0-mini 对 bytedance/seedance-2.0
render("bytedance/seedance-2.0", "a paper boat on a rain-slick street, neon reflections").then(console.log);
值得记住的这个切换点:成本路由是一个字符串的改动(草稿用 bytedance/seedance-2.0-mini,成品用 bytedance/seedance-2.0),不是第二次集成,因为两个档位是同一个端点、同一个计费单位。
一条路径搞定选型
flowchart TD
A[你发布的是哪个视频模型?] --> B{Seedance 还是 Wan?}
B -->|是,且上量| C{想要一份可预测账单<br/>+ 大模型共用一把密钥?}
C -->|是| D[Ofox 网关<br/>按输出秒]
C -->|否,想自己跑| E[Replicate 硬件轨道<br/>或自托管 Wan]
B -->|否,西方模型| F{Runway / Luma / Veo?}
F -->|是,且上量| G[直连厂商<br/>跳过转售加价]
F -->|只是测试| H[fal,目录最广]
B -->|Kling / Pika / Sora| H
对多数发布当代 Seedance 或 Wan 的团队,决策收敛成一句话:网关上的按输出秒计费给你一个跑之前就能填进表格的数字,而且在同一款旗舰模型上约为 fal 一半的价。这种可预测性,比价格表里任何一行都更能构成切换的理由。
想要更深的价格算账和逐个模型的分析,可以看完整的 fal、Replicate、Ofox 三方视频价格深拆、Seedance 2.0 Fast 与 Mini 档位对比、Seedance 2.0 与 Wan 正面对决、Sora、Veo、Kling 视频 API 横评、Kling 2.6 Pro 视频 API 指南,以及 Veo 3.1 视频 API 教程。
常见问题
下面的问题对应「fal 替代方案」和「视频 API 定价」在搜索里「大家还在问」中出现的内容。完整答案在页面的结构化数据里。
本次更新核对的来源
- fal.ai 定价页:
https://fal.ai/pricing - fal.ai Seedance 2.0 模型页:
https://fal.ai/models/bytedance/seedance-2.0/text-to-video - fal.ai Veo 3 与 Veo 3.1 模型页:
https://fal.ai/models/fal-ai/veo3,https://fal.ai/models/fal-ai/veo3.1 - fal.ai Wan 2.5 模型页:
https://fal.ai/models/fal-ai/wan-25-preview/text-to-video - fal.ai Wan 2.7 模型页:
https://fal.ai/models/fal-ai/wan/v2.7/text-to-video - Pika 定价页:
https://pika.art/pricing - fal.ai Pika 2.2 模型页:
https://fal.ai/models/fal-ai/pika/v2.2/text-to-video - Replicate 定价页:
https://replicate.com/pricing - Replicate 计费文档:
https://replicate.com/docs/topics/billing - Replicate 文生视频合集:
https://replicate.com/collections/text-to-video - MiniMax 国际站视频定价:
https://platform.minimax.io/docs/guides/pricing-video - Pika API 页(确认 API 经由 fal.ai):
https://pika.art/api - Ofox Seedance 2.0 模型页
- Ofox Wan 2.7 模型页
- Ofox 视频 API 文档:
https://ofox.ai/docs/api/videos - Ofox
GET /v1/models(每秒视频起价,2026-07-26 核对)
