fal.ai の代替 (2026): 秒単価で選ぶ動画生成API 6選
実際の秒単価で選ぶfal.ai動画代替。同じSeedance 2.0が1080pで$0.34/s、falの$0.68/sの約半分。ReplicateやセルフホストもAPIキー1本で。
TL;DR: fal.aiはカタログが広い一方、モデルごとの課金には2つの落とし穴が隠れています。表示価格が下位ティアを買っているだけのことが多く、同じモデルが定額プロバイダーの2倍かかることもあります。同じSeedance 2.0の1080pで、OpenAI互換ゲートウェイ(ofox.ai)は$0.34/s(5秒クリップあたり$1.70)に対し、falは音声込みで$0.682/s($3.41)で、およそ半分です。オープンウェイトモデルを自前で動かすなら、Replicateのハードウェア課金が有利。RunwayやVeoのような欧米系ファーストパーティモデルが必要なら、falで転売されたものを使うより、ベンダーに直接つなぐのが本当の代替です。本記事では、唯一重要な数字、すなわち条件を揃えたモデルを揃えた解像度で動かすコストで、6つの代替をランク付けします。
どのfal代替を選ぶべきか?
どのカタログが一番大きく見えるかではなく、実際に何を生成するかで選びましょう。falは幅広さで勝ります。アカウント1つでVeo、Kling、Hailuo、Pika、Seedanceに届きます。ですが幅広さは価格ではなく、多くのチームが量産で使うモデルには、より安く予測しやすい道が存在します。
| シナリオ | おすすめ | 理由 |
|---|---|---|
| 現行のSeedance / Wanを量産、請求を予測したい | Ofox(ゲートウェイ) | 解像度別の出力秒単価、APIキー1本、同じSeedance 2.0がfalの約半額 |
| 自前でデプロイするオープンウェイト/カスタムモデル | Replicate | ハードウェア秒課金、モデルを完全に制御、公開実行の失敗は無料 |
| 中国モデルではなく、RunwayやVeoが特に必要 | ベンダー直接 | 転売の上乗せを回避。Runway、Luma、GoogleのGemini APIへ直接 |
| Hailuoが本命で、一次ソースから使いたい | MiniMax直接 | 公式の国際版プラットフォーム。ただしパックの最低額が高い |
| 動画に加えテキスト・画像モデルもキー1本で | Ofox(ゲートウェイ) | Seedance、Wan、LLMを単一のOpenAI互換エンドポイントで |
| 絶対的な最安、クリップ課金ゼロ、運用は自前 | Wanをセルフホスト | 自前GPUでオープンウェイト、秒単価の上乗せゼロ |
この記事の残りは、その表の根拠です。なぜfalを離れるのか、各代替の課金方式、同一モデルでの価格計算、そして乗り換えるためのコードを示します。
開発者がfal代替を探す理由
falは、膨大な動画モデルのカタログを1つのすっきりしたAPIの背後にまとめるという仕事を、本当にうまくこなしています。他を探す理由は限定的で具体的、そしてそのすべては価格の付け方に行き着きます。
| 離れる理由 | 意味するところ | 代替が助けになる点 |
|---|---|---|
| モデルごとの課金単位 | 秒単位のモデル、動画1本単位のモデル、Seedanceは100万トークン単位 | 出力秒の定額プロバイダーなら請求が予測できる |
| 同じモデルなのに高い | Seedance 2.0の1080pはfalで音声込み約$0.68/s | ゲートウェイは同じモデルを$0.34/sで課金 |
| 表示価格が前世代のもの | Wan 2.5の$0.05/sは480pの前世代ウェイトで、現行Wan 2.7の割引ではない | レートだけでなくモデルのバージョンを揃える |
| ファーストパーティモデルへの転売上乗せ | Veo、Runwayなどはfal経由で転売されている | ベンダー直接なら中間層がなくなる |
| 動画専用アカウント | falはメディアAPIで、LLMスタックとは別 | ゲートウェイなら動画とテキストをキー1本に |
どれもfalが間違っているという話ではありません。ただ、現行世代のSeedanceやWanを量産するチーム、あるいはすべてを1つの請求にまとめたいチームにとっては、既定の選択として不向きだというだけです。本記事はまさにそのケースを軸に組み立てています。
クイックスペック:6つの代替を一覧で
以下の数字は、秒単価を挙げている箇所ではすべて解像度を揃えており、2026年7月時点で各ベンダーのライブ価格ページから取得しています。解像度の付いていないレートは比較になりません。
| 代替 | 主な課金単位 | 現行動画の最安レート | 中国モデルをホスト? | 登録のハードル |
|---|---|---|---|---|
| Ofox(OpenAI互換ゲートウェイ) | 出力秒、解像度で段階制 | Seedance 2.0 Mini $0.04/s(480p) | Seedance、Wan、HappyHorse | キー1本、カード、従量課金 |
| Replicate | ハードウェア秒、または公式モデルは出力秒 | 公式動画 約$0.09/s(480p) | Kling、Wan、Seedance、Hailuo | キー1本、カード、従量課金 |
| MiniMax / Hailuo(直接) | クリップごとの前払い動画ポイント | Hailuo-02 512p/6s クリップあたり約$0.07 | ネイティブ(HailuoはMiniMax) | 国際版、パックの下限が高い |
| Runway(直接) | クレジット、出力秒あたり | 現行のGen-4プランを参照 | いいえ、欧米系ファーストパーティ | アカウント、カード、プランのティア |
| Google Veo(Gemini API経由で直接) | 出力秒あたり | 現行のVeoティアを参照 | いいえ、欧米系ファーストパーティ | Google Cloud / Gemini APIキー |
| Wanをセルフホスト(オープンウェイト) | 自前のGPU時間 | 電気代とGPU | Wanはオープンウェイト(Alibaba) | 運用は自前 |
この表から2つ読み取れます。まず、明快で低く、現行世代の秒単価を持つ代替は、ゲートウェイとReplicateの公式モデルだけです。次に、ベンダー直接の道(Runway、Veo、MiniMax)は、転売の上乗せと引き換えに自社のオンボーディングを課すもので、そのモデルがまさに必要な場合にのみ見合います。
各代替の課金方式(そしてfalが痛いところ)
「秒単位」は、これらのプラットフォームの間で少なくとも4つの異なる意味を持ちます。素朴な比較が誤解を招くのは、まさにこれが理由です。
Ofoxは出力秒単位で課金し、解像度で段階制です。カタログの数字はそのモデルの480pの下限です。Seedance 2.0は480pで$0.07/s、720pで$0.16/s、1080pで$0.34/s、4Kで$1.37/s。したがって5秒・1080pのクリップは5 × $0.34 = $1.70です。Wan 2.7は720pで$0.10/s、1080pで$0.15/s。ハードウェア課金もアイドル課金もありません。POST /v1/videosに投げ、ジョブがcompletedになるまでポーリングすると、請求はduration × その解像度のレートです。Seedance、Wan、そしてテキストモデルがすべてキー1本の背後にあるので、動画も同じコードパスと同じ請求書に加わります。
falはモデルごとに課金し、単位は一貫していません。価格ページには、課金は「出力単位で、モデルに応じて秒単位または動画単位」とあります。きれいな秒単位のものもあります。Wan 2.5は$0.05/s(480p)、$0.10/s(720p)、$0.15/s(1080p)、Veo 3は音声オフで$0.50/sまたは音声オンで$0.75/s、Veo 3.1はより安く$0.20/s〜$0.40/s。動画1本単位のものもあります。Seedanceは100万動画トークン単位で、720pで約$0.3034/s、1080p音声込みで約$0.682/sになります。一方、旧世代のSeedance 1 Proは約$0.124/sあたりに落ち着きます。falの表示が秒単位なのか、どのモデル世代なのかは、そのページを開くまで前提にできません。
Replicateには、人がつまずく2つのトラックがあります。ほとんどの公開モデルはハードウェア時間で課金され、GPUが動いた秒数に対して支払います。T4の$0.000225/sからH100の$0.001525/sまで。H100で90秒かかるレンダーはGPU時間で90 × $0.001525 = $0.137ですが、レンダー時間は変動し、実行前には予測しにくいものです。これとは別に、Replicateが厳選した公式モデルは他社同様に出力秒単位で課金され、480pで約$0.09/s、720pで約$0.25/s。旧Seedance liteラインは$0.018/sという低さで掲載されています。公開モデルの失敗した実行には課金されませんが、プライベートモデルやデプロイはセットアップ時間やアイドル時間にも課金されます。
**MiniMax / Hailuo(直接)**は前払いの動画ポイントで課金します。Hailuo 2.3の768p・6秒クリップは1ポイント、1080p・6秒は2ポイント、安価なHailuo-02の512p帯は0.3ポイントです。ポイントパックは1ポイントあたり約$0.224〜$0.266なので、そのフラッグシップクリップは約$0.22〜$0.27になります。難点は、公開されているパックが数千ドル規模から始まることなので、契約前に現在の少額の従量課金の条件を確認してください。
同じクリップが、ゲートウェイでは一定の$1.70、falでは音声込みで$3.41。この差は割引ではなく、同じモデルを2通りに値付けしただけです。
同じモデル、違う請求:プラットフォーム横断のSeedanceとWan
Seedance 2.0とWanはfal、Replicate、そしてゲートウェイのいずれにもあるので、最も公平なテストになります。モデルと解像度を固定してから、レートを読みましょう。
| モデル・解像度 | Ofox | fal | Replicate |
|---|---|---|---|
| Seedance 2.0、480p | $0.07/s | トークン単位、より高い | 公式は秒単位 |
| Seedance 2.0、1080p | $0.34/s | 約$0.682/s(音声) | 公式、モデルページ参照 |
| Seedance 2.0 Mini、480p | $0.04/s | (同じティアではない) | 旧lite 約$0.018/s(前世代) |
| Wan 2.7(現行)、720p | $0.10/s | $0.10/s | wan-2.1 720p $0.25/s |
| Wan 2.7(現行)、1080p | $0.15/s | $0.15/s | モデルページ参照 |
| Wan 2.5(前世代)、480p | (非対応) | $0.05/s | $0.09/s(wan-2.1 480p) |
よく読んでください。最新のSeedanceではゲートウェイがfalの約半額。現行のWan 2.7では両者が同一なので、同じ数字にモデルごとの課金体系を払う理由はありません。falが安く見えるのは旧製品だけです。Wan 2.5の$0.05/sは480pで値付けされた前世代で、その1080p帯は$0.15/sと現行Wan 2.7と同じ。Seedance 1 Proも前世代です。Replicate公式の秒単位動画は現行モデルではどちらより高く、唯一最も安い素のレートである$0.018/sあたりの旧Seedance liteラインは、昨年の品質です。
価格の計算:現実的な月2,000クリップ
レートは掛け算するまで抽象的なままです。小さなコンテンツチームが、Seedance 2.0で月2,000クリップ、各5秒・1080pをレンダリングするとします。これは出力10,000秒です。
| プロバイダー | レート(Seedance 2.0、1080p) | 月額請求 | ゲートウェイ比 |
|---|---|---|---|
| Ofox | $0.34/s | $3,400 | 基準 |
| fal(音声オン) | $0.682/s | $6,820 | +$3,420(2.0倍) |
| fal(音声オフ、ページの推定) | モデルページを参照 | 変動 | 最新を確認 |
| OfoxでSeedance 2.0 Miniに落とす(720p) | $0.08/s | $800 | ドラフト帯へのルーティング |
要点は、ある数字が常に最安だということではありません。まったく同じモデルと解像度で、モデルごとの上乗せが請求をおよそ2倍にすること、そしてドラフトや大量のレンダーを安いティア(720pのMini)に切り替えれば、エンドポイントを離れずに請求をさらに数分の一に減らせること、これが要点です。予測できる秒課金があるからこそ、そのルーティングの判断が2つ目の統合ではなく1行の変更で済むのです。
6つの代替を1つずつ
1. Ofox、OpenAI互換ゲートウェイ
現行世代のSeedanceやWanを量産し、予測できる請求を1つにまとめたいチームに最適。Seedance 2.0、そのMiniとFastの各ティア、そしてWan 2.7を、テキスト・画像モデルと同じエンドポイント上で、解像度別の出力秒単価で、キー1本の背後から使えます。Kling、Veo、Soraはホストしていないので、それら特定のファーストパーティモデルがパイプラインなら不向きです。取り扱うモデルについては、この比較で最も安い現行世代のアンカーです。
2. Replicate
自前でデプロイして制御したいオープンウェイトやカスタムモデルに最適。ハードウェア秒課金のトラックでは、コンテナ化できるどんなモデルでも動かせ、GPUのレンダー時間だけを支払えばよく、マイナーなオープンウェイトモデル1つなら、あらゆるマネージド秒課金より安くなり得ます。ただし運用を自前でやる代償が伴います。厳選された公式モデルは、他社同様に出力秒単位で課金されます。公開実行の失敗は無料で、これはプロンプトを反復するときに効いてきます。トレードオフは予測しやすさです。ハードウェアトラックでは出力秒ではなくレンダー時間に支払うので、遅いモデルは請求が膨らみます。
3. MiniMax / Hailuo、直接
Hailuoが特に本命で、一次ソースから使いたいときに最適。MiniMaxは中国向けコンソールとは別に、platform.minimax.ioで国際版プラットフォームを運営しており、中国国外の開発者もメールまたはOAuthで登録できます。課金は前払いの動画ポイントで、1ポイントあたり約$0.22〜$0.27、Hailuo 2.3の768p/6sクリップは1ポイントです。ハードルは公開パックで、数千ドル規模から始まるため、1回のレンダーを試す人より、実際に量のあるチーム向きです。Hailuoを安く試したいだけなら、falやReplicateでも転売されています。
4. RunwayとLuma、直接
中国モデルではなく、RunwayのGen-4ラインやLumaのRayといった欧米系ファーストパーティモデルが必要なときに最適。どちらも自社APIを運営し、クレジットベースで出力秒課金、そしてどちらもfal経由で転売もされています。ここでのfal代替の一手は、直接つないで転売レイヤーを外すことで、そのモデルがまさにパイプラインで、上乗せを気にするだけの量がある場合にのみ見合います。クレジットとドルの換算やプランのティアは、定額の秒単価表より変わりやすいので、各ベンダーの最新プランページで価格を確認してください。
5. Google Veo、Gemini API経由で直接
Veoが欲しいモデルで、転売業者よりGoogleと直接関係を持ちたいときに最適。Veo 3と3.1はGoogleのGemini APIおよびVertex AI経由で利用でき、出力秒単位で課金され、falにもあります(Veo 3は$0.50〜$0.75/s、Veo 3.1はより安く$0.20〜$0.40/s)。直接つなぐということは、メディアアグリゲーターではなくGoogle Cloudプロジェクトとそのアクセスルールを使うことなので、判断はモデル自体ではなく、どの課金関係とクォータモデルを望むかにかかっています。
6. オープンウェイトのWanをセルフホスト
クリップ課金を一切なくしたく、運用の予算があるチームに最適。AlibabaのWanモデルはオープンウェイトなので、自前または借りたGPUで動かし、計算リソースだけを支払えます。これは大量運用時のクリップあたり限界コストの下限であり、同時に運用作業の上限でもあります。配信スタック、キュー、リトライ、そしてレンダー中でもアイドルでも発生するGPU請求を、すべて自分で持つことになります。ほとんどのチームでは、量が非常に多くなるまで、マネージドの秒課金が総所有コストで勝ります。
falに留まるべきとき
falが正解であることは、はっきり言えるくらい多くあります。パイプラインがアカウント1つで最も広いファーストパーティのカタログ、つまり5社を統合せずにVeo、Kling、Hailuo、Pika、Seedanceを必要とするなら、falはまさにそのために作られています。特にKlingに縛られているなら、ゲートウェイはホストしていないので、ソースはfalかReplicateです。そしてPikaにはそもそもファーストパーティのAPIがなく、公式ドキュメント自体がAPIユーザーをfalに案内しているため、falが実質的にPikaのAPIです。幅広さとファーストパーティの網羅性は、留まる本当の理由です。大量に使う単一モデルの価格が、離れる理由です。
Ofoxで最安の現行世代パスを試す
実際に本番で使うモデルがSeedanceやWanなら、乗り換えは小さな作業です。同じOpenAI SDK、異なるbase_url、そして動画モデルID。ジョブを投げ、completedになるまでポーリングします。
Python、1つのエンドポイントでSeedanceジョブを投げる
import os, time, requests
OFOX = "https://api.ofox.ai/v1"
KEY = os.environ["OFOX_API_KEY"]
HEADERS = {"Authorization": f"Bearer {KEY}", "Content-Type": "application/json"}
def render(model: str, prompt: str, resolution: str = "1080p", seconds: int = 5) -> str:
# ジョブを投げる
r = requests.post(f"{OFOX}/videos", headers=HEADERS, json={
"model": model, # ここでティアを差し替えるだけ、他は変わらない
"prompt": prompt,
"duration": seconds,
"resolution": resolution,
})
job_id = r.json()["id"]
# 終端状態(completed / failed / cancelled / expired)までポーリング
while True:
s = requests.get(f"{OFOX}/videos/{job_id}", headers=HEADERS).json()
if s["status"] in ("completed", "failed", "cancelled", "expired"):
break
time.sleep(2)
if s["status"] != "completed":
return s["status"]
# 完了ジョブはunsigned_urls(TTL 24時間)を返す。mirror_urlsがあれば永続
return (s.get("unsigned_urls") or s.get("mirror_urls") or [None])[0]
# Miniでドラフト($0.04/sの下限)、本番はフラッグシップでレンダー
draft = render("bytedance/seedance-2.0-mini", "a paper boat on a rain-slick street, neon reflections", "720p")
final = render("bytedance/seedance-2.0", "a paper boat on a rain-slick street, neon reflections", "1080p")
print(draft, final)
Node、同じ形
const OFOX = "https://api.ofox.ai/v1";
const HEADERS = {
Authorization: `Bearer ${process.env.OFOX_API_KEY}`,
"Content-Type": "application/json",
};
async function render(model, prompt, resolution = "1080p", seconds = 5) {
const r = await fetch(`${OFOX}/videos`, {
method: "POST",
headers: HEADERS,
body: JSON.stringify({ model, prompt, duration: seconds, resolution }),
});
const { id } = await r.json();
// 終端状態までポーリング
while (true) {
const s = await (await fetch(`${OFOX}/videos/${id}`, { headers: HEADERS })).json();
if (["completed", "failed", "cancelled", "expired"].includes(s.status)) {
if (s.status !== "completed") return s.status;
// 完了ジョブはunsigned_urls(TTL 24時間)を返す。mirror_urlsがあれば永続
return (s.unsigned_urls || s.mirror_urls || [])[0] || s.status;
}
await new Promise((r) => setTimeout(r, 2000));
}
}
// 文字列1つでティアを差し替え:bytedance/seedance-2.0-mini と bytedance/seedance-2.0
render("bytedance/seedance-2.0", "a paper boat on a rain-slick street, neon reflections").then(console.log);
腹落ちさせておきたい要点。コストのルーティングは1つの文字列の変更(ドラフトはbytedance/seedance-2.0-mini、最終版はbytedance/seedance-2.0)であって、2つ目の統合ではありません。どちらのティアも同じエンドポイント、同じ課金単位だからです。
1本の経路で選ぶ
flowchart TD
A[どの動画モデルを本番で使う?] --> B{SeedanceかWan?}
B -->|はい、量産で| C{予測できる請求1つ<br/>+ LLMもキー1本に?}
C -->|はい| D[Ofoxゲートウェイ<br/>出力秒単位]
C -->|いいえ、自前で動かす| E[Replicateハードウェアトラック<br/>またはWanをセルフホスト]
B -->|いいえ、欧米系モデル| F{Runway / Luma / Veo?}
F -->|はい、量産で| G[ベンダー直接<br/>転売の上乗せを回避]
F -->|試すだけ| H[fal、最も広いカタログ]
B -->|Kling / Pika / Sora| H
現行世代のSeedanceやWanを本番で使うほとんどのチームにとって、判断は1行に収束します。ゲートウェイの出力秒課金なら、実行前にスプレッドシートに書き込める数字が、同じフラッグシップモデルでfalの約半額で手に入ります。価格表のどの1行より、その予測可能性こそが乗り換える理由です。
さらに詳しい価格の計算や個々のモデルについては、fal対Replicate対Ofoxの動画価格の内訳、Seedance 2.0 Fast対Miniのティア比較、Seedance 2.0対Wanの直接対決をご覧ください。
FAQ
以下の質問は、fal代替や動画API価格について「他の人はこちらも質問」に表示される内容を反映しています。完全な回答はページの構造化データに含まれています。
今回の更新で確認したソース
- fal.ai 価格ページ:
https://fal.ai/pricing - fal.ai Seedance 2.0 モデルページ:
https://fal.ai/models/bytedance/seedance-2.0/text-to-video - fal.ai Veo 3・Veo 3.1 モデルページ:
https://fal.ai/models/fal-ai/veo3,https://fal.ai/models/fal-ai/veo3.1 - fal.ai Wan 2.5 モデルページ:
https://fal.ai/models/fal-ai/wan-25-preview/text-to-video - fal.ai Wan 2.7 モデルページ:
https://fal.ai/models/fal-ai/wan/v2.7/text-to-video - Pika 価格ページ:
https://pika.art/pricing - fal.ai Pika 2.2 モデルページ:
https://fal.ai/models/fal-ai/pika/v2.2/text-to-video - Replicate 価格ページ:
https://replicate.com/pricing - Replicate 課金ドキュメント:
https://replicate.com/docs/topics/billing - Replicate テキスト→動画コレクション:
https://replicate.com/collections/text-to-video - MiniMax 国際版動画価格:
https://platform.minimax.io/docs/guides/pricing-video - Pika API ページ(APIがfal.ai経由であることを確認):
https://pika.art/api - Ofox Seedance 2.0 モデルページ
- Ofox Wan 2.7 モデルページ
- Ofox 動画APIドキュメント:
https://ofox.ai/docs/api/videos - Ofox
GET /v1/models(秒単位の動画下限、2026-07-26確認)
