Seedance 2.0: как пользоваться, 6 фиксов и цена (2026)

Лицо плывёт, лезут субтитры? Спецификация промптов ByteDance, 6 фиксов и 720p по $0.16/с через один ключ ofox.

Seedance 2.0: как пользоваться, 6 фиксов и цена (2026)

Seedance 2.0 принимает текст, изображения, видео и звук и возвращает клипы длиной от 4 до 15 секунд со синхронной звуковой дорожкой, с тарификацией за секунду вывода от $0.04/с. У ByteDance для неё есть настоящая спецификация промптов: формула, четыре знака препинания, которые модель обучена читать, бюджет референсов, который вас просят не выбирать целиком, и список задокументированных сбоев с исправлениями. Русскоязычные и англоязычные руководства обычно советуют «написать подробный и яркий промпт» и ни о чём из этого не упоминают.

Эта страница и есть та спецификация, проверенная 2026-08-06, сверенная с тем, что сообщают люди, реально работающие с моделью, плюс сколько стоит клип на каждом из входов.

Что можно делатьТекст, изображение, видео и звук в видео, 4–15 секунд, до 4K, синхронный звук по умолчанию
Время до первого клипаОколо 2 минут в Dreamina, около 5 минут через API
Что нужноПотребительский аккаунт ByteDance либо один ключ API
Самый дешёвый реальный клип$0.16 за 4 секунды в 480p на bytedance/seedance-2.0-mini
Самая дешёвая секунда 720p$0.08/с на Mini, $0.16/с на флагмане
Главный сбойЛицо персонажа плывёт на середине клипа, лечится отдельным портретным кадром
Снимок данных2026-08-06

Где можно пользоваться Seedance 2.0?

Пять входов, и только один из них даёт посекундную ставку, которую вы можете проверить без потребительского аккаунта ByteDance.

ВходЧто этоПрактическая загвоздка
DreaminaМеждународное веб-приложение ByteDanceРазмер кредитов не публикуется; промпты с лицами фильтруются жёстко
JimengПриложение для внутреннего китайского рынкаНужен китайский номер телефона и аккаунт Douyin, интерфейс только на китайском
DoubaoПотребительский ассистент ByteDanceТа же привязка к китайскому аккаунту
ComfyUIЛокальный граф нод, но ноды ходят в APIСчёт всё равно идёт на хостинговый API, на вашей видеокарте ничего не считается
APIЛюбой агрегатор или хостинг-провайдерВеса закрыты, поэтому любой маршрут упирается в чей-то хостинговый эндпоинт

Главное, что путают: Seedance 2.0 не является моделью с открытыми весами. Нет локальной установки, нет GGUF, нет «запущу на 4090». Каждый путь в этой таблице заканчивается моделью, размещённой у ByteDance, и выбирать вы можете только того, кто выставит вам счёт.

Если нужен программный маршрут, все три тарифа сидят на одном эндпоинте в ofox: bytedance/seedance-2.0, bytedance/seedance-2.0-fast и bytedance/seedance-2.0-mini. Полная форма запроса и опроса статуса разобрана в руководстве по доступу к API Seedance 2.0.

Бесплатна ли Seedance 2.0?

Нет, а те, кто называет вам точное число кредитов, это число выдумали.

На собственной странице Dreamina про Seedance написано лишь, что Dreamina «может предоставлять бесплатные пробные кредиты подходящим пользователям» и что «точное количество кредитов и доступность могут отличаться. Войдите в Dreamina, чтобы посмотреть свои текущие условия». То есть вендор сознательно не публикует цифру. Все статьи, уверенно перечисляющие «260 кредитов с ежедневным обновлением», цитируют другую статью, а не ByteDance.

Что на самом деле известно:

  • Потребительские входы дают новым аккаунтам какое-то количество пробных кредитов. Объём зависит от аккаунта, и письменных обязательств у ByteDance нет.
  • Бесплатного тарифа API не существует нигде. Любой программный маршрут тарифицируется за секунду вывода.
  • Настоящий нижний предел — $0.04/с на Mini в 480p. Тестовый клип на 4 секунды стоит $0.16, что достаточно близко к бесплатному, чтобы оценить, справится ли модель с вашей задачей.

Если цель просто попробовать модель до того, как тратить реальные деньги, генерируйте в 480p на Mini вместо охоты за несуществующим бесплатным тарифом. Десять тестовых клипов обойдутся меньше чем в два доллара.

Что выбрать: приложение или API?

Приложение, если вы делаете одно видео. API в тот момент, когда вы делаете то же самое видео второй раз.

Приложение подходит, когда:

  • Вы исследуете возможности модели и хотите увидеть результат до того, как вкладываться.
  • Ваш процесс — по одному клипу за раз, и каждый результат оценивает человек.
  • Вам нужен встроенный редактор, а не скачивание файлов.

API подходит, когда:

  • Вы делаете варианты потоком, и посекундная ставка выигрывает у пакета кредитов, который невозможно проверить.
  • Результаты нужны в конвейере, с callback_url вместо человека, следящего за полосой прогресса.
  • Вы хотите сравнить три тарифа на одном промпте, а это правка одной строки.

Правило остановки: если вы генерируете меньше примерно двадцати клипов в месяц и вам не нужны файлы в конвейере, потребительского приложения достаточно, а остальное на этой странице можно не читать. Всё дальше написано в расчёте на то, что качество вывода вам важно настолько, чтобы им управлять.

Как писать промпт для Seedance 2.0?

Пишите инструкцию, а не описание. Официальное руководство по промптам от ByteDance прямо говорит: модель раскладывает ввод на пространственный слой (что находится в кадре) и временной слой (как это меняется). Промпт, который читается как рекламный текст, не даёт временному слою ничего.

Опубликованная продвинутая формула, по порядку:

точный субъект + детали действия + сцена/окружение + свет и тональность
+ движение камеры + визуальный стиль + качество изображения + ограничения

Для работы с референсами есть три более коротких шаблона, и разница между ними важнее, чем кажется:

ЗадачаШаблон
Мультимодальный референсReference <Subject_N> in <Image_N> to generate...
Редактирование видеоStrictly edit <Video_N>, and modify <Original> to <New>
Продление видеоExtend <Video_N> forward/backward to generate...

Ловушка в документации оформлена как примечание, и в неё легко попасть. В задачах редактирования и продления на клип ссылаются напрямую как <Video_1>. Напишете reference <Video_1> — и модель классифицирует всю работу как задачу с референсом, а вы получите новое видео вместо отредактированного.

Ещё три правила из того же руководства, идущие вразрез с тем, как обычно пишут промпты для видеомоделей:

  1. Предпочитайте мелкое, медленное, непрерывное движение. Руководство просит избегать спринта, больших прыжков и резких перекатов и советует «медленно идти, мягко поднять руку, слегка опустить голову». Именно самые эффектные экшен-промпты и разваливаются.
  2. Одно движение камеры на кадр. Требовать в одном кадре и наезд, и отъезд, и панораму, и проводку — значит терять стабильность картинки. Выберите одно.
  3. Не фиксируйте точный тайминг. Поддержка указаний вроде «0–3 секунды» описана как нестабильная, а принудительное ограничение «может приводить к аномальным результатам генерации». Задайте порядок кадров, но не хронометраж.

Если в материале больше одного такта, делайте раскадровку. Пометьте сегменты Shot 1, Shot 2, Shot 3 в порядке событий и для каждого укажите движение камеры, затем действие субъекта, затем положение, затем звук. Собственный отрицательный пример руководства: «мужчина нервно бежит по улице, и сцена выглядит очень кинематографично». Ровно та фраза, которая хорошо читается и плохо генерируется.

Какие символы Seedance 2.0 действительно читает?

Четыре, и они не декоративные. ByteDance обучала модель на соглашении о пунктуации, которое отделяет типы звука друг от друга и от описания картинки. Реплики, написанные обычной прозой, — вот почему во многих клипах слова возвращаются впечатанными в кадр как текст.

Тип информацииСимволПример
Музыка()(fast-paced rock music is playing in the background)
Звуковой эффект<><dog barking can be heard in the distance>
Реплика{}{Hello, world}
Субтитры【】【Chapter One: Departure】

Есть два условия. Реплики на языке, отличном от китайского и английского, нужно помечать: says in Japanese {こんにちは}. И руководство просит держать язык реплик единым в пределах клипа, не смешивая китайский с английским, за исключением имён собственных.

Сколько референсных изображений прикладывать?

Четыре или пять. Не пятнадцать.

Seedance 2.0 принимает до 9 изображений, 3 видеоклипов и 3 аудиофайлов за одну генерацию. Это число есть на каждой маркетинговой странице модели, обычно как главная фича. А потом собственное руководство ByteDance говорит его не выбирать: «Не рекомендуется использовать полный лимит материалов. Слишком много материалов затрудняет для модели определение приоритета признаков», результат — конфликты стилей, размытая идентификация субъекта и уход от того, что вы просили.

Рекомендованная конфигурация даёт каждому материалу свою работу:

  • 1–2 изображения персонажа, крупный план лица и в полный рост, чтобы закрепить внешность
  • 1 изображение сцены, чтобы задать окружение и стиль
  • 1 видео-референс движения камеры, чтобы зафиксировать язык кадра и ритм
  • 1 аудиофрагмент, чтобы управлять эмоцией и тембром

Порядок тоже важен. Чем точнее нужно следовать материалу, тем раньше он идёт в промпте.

Почему у персонажа меняется лицо на середине?

Потому что референс лица размыт, а не потому что модель плохо рисует лица.

Задокументированная первопричина — смешанное референсное изображение: одна картинка несёт сразу лицо, позу, одежду и детали. Лицо занимает малую долю кадра, модель присваивает его признакам низкий вес, и фон побеждает. К середине клипа персонаж тихо становится кем-то другим.

Исправление состоит из трёх частей:

  1. Подготовьте отдельный портретный кадр, где есть только голова. Без плеч, без шеи, с минимальным фоном, лучше всего без выражения.
  2. Назовите роли в промпте и привяжите их к материалам в форме «определить женщину в красном платье и соломенной шляпе на Изображении 1 как Subject 1», а затем используйте эту же метку каждый раз, когда упоминаете её.
  3. Поставьте референс лица первым среди материалов.

Одно контринтуитивное указание: не используйте многоракурсные листы персонажа. Они выглядят очевидным способом дать модели стабильного героя, и именно они являются задокументированной причиной бага с «двойниками», когда один и тот же человек появляется в кадре дважды, потому что модель прочитала разные ракурсы как разных людей.

Почему Seedance добавляет субтитры, которых я не просил?

Потому что она обучена на видео с субтитрами, и руководство признаёт, что полностью подавить это нельзя. Формулировка ByteDance: «на данный момент невозможно напрямую избежать генерации субтитров на 100%». В распоряжении есть три рычага снижения вероятности:

  • Внесите явное ограничение в промпт: «сохранять без субтитров» и «не генерировать никакого текста или субтитров».
  • Уберите текст из референсных изображений до подачи, а не надейтесь, что модель его проигнорирует.
  • Если формат сдачи позволяет, генерируйте горизонтально и потом обрезайте. Руководство утверждает, что вероятность посторонних субтитров заметно ниже в горизонтальной ориентации, чем в вертикальной, и для вертикального социального видео это по-настоящему полезно знать.

Последний пункт из тех деталей, которые встречаются только в документации вендора. И он же прямо противоположен тому, что по умолчанию сделает вертикально ориентированный процесс.

Что ещё ломается и как это чинить?

Задокументировано шесть сбоев, у каждого есть исправление. Все они относятся к поведению модели, а не к ошибкам пользователя, поэтому ни один не лечится более длинным промптом.

СимптомИсправление
1Лицо персонажа меняется на серединеОтдельный портретный кадр, явные метки ролей, важнейший материал первым, без многоракурсных листов
2Субтитры, которых вы не просилиЯвные слова-ограничения, референсы без текста, генерация горизонтально с обрезкой
3Появляется логотип или водяной знак чужой платформыДобавить «не генерировать водяные знаки» и «не генерировать логотипы» как ограничения
4Аниме-стиль уплывает в реалистичную съёмкуЯвно назвать стиль и заранее перевести референсное изображение в целевой стиль
5Скачок на стыке при продлении клипаОбрезать 6 кадров с конца предыдущего сегмента и 1 кадр с начала следующего, на каждом стыке
6Один и тот же персонаж дважды в кадреПривязать каждую роль к своему изображению, добавить запрет на дублирование персонажей, использовать одиночные фото

Пятый пункт стоит запомнить, потому что это точное число, а не совет. Шесть кадров и один кадр на каждый стык, в любом монтажном редакторе. Повторные продления к тому же накапливают деградацию качества, и цветные пятна первыми выступают на лицах, поэтому руководство советует перед продолжением превратить исходник в проход с белой 3D-моделью и не злоупотреблять количеством продлений.

Сколько стоит клип в Seedance 2.0?

За секунду вывода, со ставкой, растущей по разрешению. Цифры «от $0.04» и «от $0.07» на каталожных страницах — это нижняя граница 480p, а в 480p почти никто не сдаёт работу. Вот полный прайс, проверенный 2026-08-06:

РазрешениеMiniFastФлагман
480p$0.04/с$0.06/с$0.07/с
720p$0.08/с$0.13/с$0.16/с
1080pнедоступнонедоступно$0.34/с
4Kнедоступнонедоступно$1.37/с

Видео из видео дороже в каждой строке: $0.10/с на Mini в 720p против $0.08/с у текста в видео, $0.45/с на флагмане в 1080p против $0.34/с.

Клип на 5 секунд, то есть та длина, которую генерируют чаще всего:

Тариф и разрешение5 секунд
Mini, 720p$0.40
Fast, 720p$0.65
Флагман, 720p$0.80
Флагман, 1080p$1.70
Флагман, 4K$6.85

Разброс между хостингами шире, чем разброс между тарифами. В июле практик в r/Seedance_AI выложил таблицу ставок (просмотрено 2026-08-06), подбирая мощности под короткие сериалы: 720p по $0.152/с у BytePlus, $0.16/с у SeeGen, $0.18/с у Replicate, $0.194/с у AtlasCloud, $0.20/с у PiAPI и $0.302/с у fal. Сегодняшняя опубликованная ставка fal — $0.3034/с для 720p со звуком и $0.682/с для 1080p, так что та таблица держится. Одна и та же модель, одни и те же веса, и примерно двукратный разброс в зависимости от того, у кого вы покупаете.

Небольшой студии, генерирующей 200 клипов в месяц по 5 секунд в 720p, это $160 в месяц по $0.16/с против $303 по текущей ставке fal $0.3034/с. Вопрос выбора тарифа разобран отдельно в сравнении Mini, Fast и флагмана, а если вы ещё не остановились на Seedance, сначала стоит посмотреть цифры в сравнении Seedance и Wan.

Ограничение, всплывающее в каждой ветке про провайдеров: референсы персонажей работают, но защищённые авторским правом персонажи и публичные фигуры отсекаются практически на любом маршруте. Стройте на своих материалах и оригинальных героях.

Два общественных приёма, которые стоит украсть

Ни одного из них нет в официальной документации. Оба пришли от людей, публикующих результаты, и оба ложатся на обычные параметры API.

Промежуточные кадры. Вместо генерации клипа из ничего сделайте первый и последний кадр, отдайте модели оба и попросите заполнить промежуток. Разошедшийся шаблон промпта держит две части неизменными, «Show what happens in between» и «5 different camera angles», и меняет только среднее предложение с описанием действия. Затем последний кадр становится следующим первым, и история двигается вперёд по кадру за раз. В терминах API это frame_images с первым и последним кадром. Вы меняете удобство генерации за один заход на контроль над темпом, и обычно это правильный обмен.

Управление траекторией. Нарисуйте маршрут камеры от руки прямо на статичном изображении, заметным цветом, затем отдайте размеченную картинку как референс и велите модели точно следовать нарисованному пути, а сами пометки убрать из результата. Показанные результаты достаточно хороши, чтобы приём стоило знать, но с честной оговоркой из самого популярного ответа в той же ветке: сгенерированная траектория полёта заметно расходится с нарисованной. Считайте это сильным направлением, а не покадровой анимацией.

Как вызвать Seedance 2.0 из кода?

Один POST, дальше опрос статуса. Эндпоинт асинхронный, ничего не стримится и ничего не блокируется.

import os, time, requests

BASE = "https://api.ofox.ai/v1"
H = {"Authorization": f"Bearer {os.environ['OFOX_API_KEY']}"}

job = requests.post(f"{BASE}/videos", headers=H, json={
    "model": "bytedance/seedance-2.0-mini",
    "prompt": (
        "Shot 1: fixed medium shot, a woman in a grey coat walks slowly to a "
        "rain-streaked window and stops. Shot 2: slow push-in to a close-up, "
        "she gently lowers her head. (soft piano) <rain on glass> "
        "Cinematic texture, natural colours, soft lighting. "
        "Keep it subtitle-free, do not generate a watermark."
    ),
    "duration": 5,
    "resolution": "720p",
    "aspect_ratio": "16:9",
}).json()

while True:
    r = requests.get(f"{BASE}/videos/{job['id']}", headers=H).json()
    if r["status"] in ("completed", "failed", "cancelled", "expired"):
        break
    time.sleep(2)

print(r["status"], r.get("usage", {}).get("video_cost"))

Замена bytedance/seedance-2.0-mini на -fast или флагман — это и есть вся смена тарифа. Если есть куда принимать вебхук, передайте callback_url вместо опроса. Полный справочник по полям, включая frame_images и input_references, лежит в руководстве по доступу, а более общий вопрос выбора видеомодели разобран в подборе по сценарию использования.

А что с Seedance 2.5?

Она вышла 2026-07-31, и на момент написания открытие её API в BytePlus было назначено на 2026-08-07. Потребительский раскат начался раньше, через Jimeng и Doubao, что для ByteDance обычный порядок.

Seedance 2.0Seedance 2.5
Длина одной генерации15 с30 с
Референсные входы9 изображений, 3 видео, 3 аудио30 изображений, 10 видео, 10 аудио
Потолок разрешения4K4K
Статус API на 2026-08-06Работает у провайдеровОткрытие 2026-08-07

Ждать стоит, если вам нужны непрерывные клипы длиннее 15 секунд, поскольку большинство заметных швов берётся именно со склейки. В остальных случаях ждать незачем: Seedance 2.0 параллельно подняли до 4K, а всё на этой странице, формула промпта, символы, бюджет материалов, шесть исправлений, написано под линейку 2.0 и переносится дальше.

Более полезная часть того анонса — то, что команда Seed в ByteDance решила признать про собственную новую модель. Не подписываясь индивидуально, коллективно, они завершают пост про Seedance 2.5 так:

«Остаётся пространство для улучшения, особенно в части физической правдоподобности сложных движений и устойчивости сцен со взаимодействием нескольких субъектов».

Прочитайте это рядом с руководством по промптам, и советы сходятся. Сложное движение ненадёжно, поэтому руководство просит медленных, мелких, непрерывных движений. Взаимодействие нескольких субъектов неустойчиво, поэтому одиночные референсы персонажа выигрывают у листов с ракурсами и поэтому вообще существует баг с двойниками. Вендор сам показывает, где модель тонка, на той же неделе, когда продаёт вам апгрейд. Планируйте кадры под это, а не против этого, и сверяйте текущий статус на ByteDance Seed, а не по дате в чьём-то блоге, включая этот.

Частые вопросы

Сколько времени занимает генерация в Seedance 2.0? От меньше минуты до нескольких минут: зависит от тарифа, разрешения, длительности и загрузки хостинга. Именно поэтому API асинхронный: вы отправляете запрос, получаете id задачи и опрашиваете статус раз в одну-две секунды, либо передаёте callback_url и получаете результат сами.

Какова максимальная длина видео в Seedance 2.0? 15 секунд за одну генерацию при минимуме в 4 секунды. Более длинные вещи собираются продлением клипа или склейкой отдельных генераций. Seedance 2.5, вышедшая 2026-07-31, поднимает потолок одной генерации до 30 секунд.

Можно ли запустить Seedance 2.0 офлайн или развернуть у себя? Нет. Веса закрытые, локальной установки и сборки GGUF не существует. Локальные инструменты вроде ComfyUI обращаются к Seedance через API-ноды, то есть генерация всё равно идёт на хостинге и всё равно тарифицируется посекундно.

Умеет ли Seedance 2.0 генерировать звук? Да, нативно, и по умолчанию это включено на всех трёх тарифах. Управляют звуком символами, которые модель обучена читать: круглые скобки для музыки, угловые для звуковых эффектов, фигурные для реплик.

Поддерживает ли Seedance 2.0 генерацию видео из видео? Да, на всех трёх тарифах, и стоит это дороже, чем текст в видео: $0.20/с против $0.16/с на 720p во флагмане и $0.45/с против $0.34/с на 1080p. Продление клипа и его редактирование тоже считаются видео в видео.

Почему мой промпт в Seedance 2.0 отклонили? Чаще всего срабатывает фильтр контента, прочитавший либо текст промпта, либо референсный материал. Типичные триггеры это защищённые авторским правом персонажи и узнаваемые публичные фигуры, причём строгость отличается от маршрута к маршруту. Надёжнее пересобрать кадр на собственных оригинальных материалах.

Какие соотношения сторон поддерживает Seedance 2.0? 16:9, 9:16, 1:1 и адаптивное. ByteDance отмечает, что у вертикального формата заметно выше вероятность непрошеных субтитров, поэтому сгенерировать 16:9 и обрезать бывает более дешёвым путём к чистому вертикальному клипу.

Источники, проверенные для этого обновления

Часто задаваемые вопросы

Сколько времени занимает генерация в Seedance 2.0?
От меньше минуты до нескольких минут: зависит от тарифа, разрешения, длительности и загрузки хостинга. Именно поэтому API асинхронный: вы отправляете запрос, получаете id задачи и опрашиваете статус раз в одну-две секунды, либо передаёте callback_url и получаете результат сами.
Какова максимальная длина видео в Seedance 2.0?
15 секунд за одну генерацию при минимуме в 4 секунды. Более длинные вещи собираются продлением клипа или склейкой отдельных генераций. Seedance 2.5, вышедшая 2026-07-31, поднимает потолок одной генерации до 30 секунд.
Можно ли запустить Seedance 2.0 офлайн или развернуть у себя?
Нет. Веса закрытые, локальной установки и сборки GGUF не существует. Локальные инструменты вроде ComfyUI обращаются к Seedance через API-ноды, то есть генерация всё равно идёт на хостинге и всё равно тарифицируется посекундно.
Умеет ли Seedance 2.0 генерировать звук?
Да, нативно, и по умолчанию это включено на всех трёх тарифах. Управляют звуком символами, которые модель обучена читать: круглые скобки для музыки, угловые для звуковых эффектов, фигурные для реплик.
Поддерживает ли Seedance 2.0 генерацию видео из видео?
Да, на всех трёх тарифах, и стоит это дороже, чем текст в видео: $0.20/с против $0.16/с на 720p во флагмане и $0.45/с против $0.34/с на 1080p. Продление клипа и его редактирование тоже считаются видео в видео.
Почему мой промпт в Seedance 2.0 отклонили?
Чаще всего срабатывает фильтр контента, прочитавший либо текст промпта, либо референсный материал. Типичные триггеры — защищённые авторским правом персонажи и узнаваемые публичные фигуры, причём строгость отличается от маршрута к маршруту. Надёжнее пересобрать кадр на собственных оригинальных материалах.
Какие соотношения сторон поддерживает Seedance 2.0?
16:9, 9:16, 1:1 и адаптивное. ByteDance отмечает, что у вертикального формата заметно выше вероятность непрошеных субтитров, поэтому сгенерировать 16:9 и обрезать бывает более дешёвым путём к чистому вертикальному клипу.