Seedance 2.0 или Wan: сравнение стоимости видео API по разрешению

Сравниваем Seedance 2.0 и Wan 2.7 по разрешению, режиму входа и провайдеру. Расчёты для 1080p и 4K и код для проверки обеих моделей через общий API.

Два вертикальных видеокадра рядом: один в тёплом оранжевом цвете ByteDance, другой в холодном синем Alibaba, разделённые тонким ценником с ценой в долларах за секунду, на тёмном фоне

Обновлено 16 сентября 2026 года: сравнивайте одинаковые разрешение и режим входа. В text-to-video 1080p Wan 2.7 дешевле Seedance 2.0, зато флагман Seedance предлагает 4K. Обе модели используют POST /v1/videos, поэтому перед выбором сравните и результат на своих промптах.

Что выбрать?

Для бюджета в 1080p начните с Wan 2.7. Для черновиков сравните нужное разрешение Seedance Mini. Если нужен 4K, используйте ставку Seedance 2.0 именно для 4K, а не стартовую цену 480p.

СценарийВыборПочему
Много клипов в 1080pWan 2.7Text-to-video $0.15/s против тарифа каталога Seedance 2.0 $0.34/s
Черновики в 720pSeedance 2.0 MiniText-to-video: каталог $0.08/s, основной провайдер Volcengine $0.04/s
Нужен вывод в 4KSeedance 2.0Единственный из двух, кто указывает 4K
Клипы короче 4 секундWan 2.7минимум 2 с против 4 с у Seedance
Уже настроены под движение AlibabaWan 2.7Цена миграции перевешивает разрыв в цене
Пока не увереныГоняйте обеОдин эндпоинт, одна строка для замены

Всё, что ниже, это математика и спеки за этой таблицей плюс точный код, чтобы запустить обе модели одним вызовом.

Быстрое сравнение спеков

Цены обновлены по тарифам Ofox catalog для соответствующих разрешений на 16 сентября 2026 года. Остальные характеристики и исторические образцы сохраняют прежний охват. Далее цены указаны в USD за секунду; тарифы каталога отделены от предложений основных провайдеров.

СпекаSeedance 2.0Seedance 2.0 FastSeedance 2.0 MiniWan 2.7Wan 2.6
ID моделиbytedance/seedance-2.0bytedance/seedance-2.0-fastbytedance/seedance-2.0-minialibaba/wan-2.7alibaba/wan-2.6
Text-to-video, каталог USD/s$0.07 (480p), $0.16 (720p), $0.34 (1080p), $1.37 (4K)$0.06 (480p), $0.13 (720p)$0.04 (480p), $0.08 (720p)$0.086 (720p), $0.15 (1080p)$0.086 (720p), $0.15 (1080p)
Макс. разрешение4K720p720p1080p1080p
Разрешение по умолчанию1080p720p720p1080p1080p
Режимыt2v, i2v, v2vt2v, i2v, v2vt2v, i2v, v2vt2v, i2v, v2vt2v, i2v
Диапазон длительности4–15 с4–15 с4–15 с2–15 с2–15 с
ЗвукДаДаДаДаДа
Соотношения сторон16:9, 9:16, 1:1, adaptiveтак жетак же16:9, 9:16, 1:116:9, 9:16, 1:1
Эндпоинт/v1/videos/v1/videos/v1/videos/v1/videos/v1/videos

Seedance 2.0 достигает 4K, а Wan 2.7 принимает клипы от 2 секунд. Эти возможности не делают стартовый тариф применимым ко всем разрешениям. В одинаковом режиме text-to-video 1080p ставка Wan ниже.

Откуда взялись Seedance и Wan

Обе модели восходят к двум китайским лабораториям с самыми глубокими исследованиями в генерации видео. Seedance это часть группы Seed от ByteDance, той же команды, что стоит за image-моделями Seedream и коротковидеоконвейером, который питает Douyin и TikTok. Wan это линия Tongyi от Alibaba, разработанная рядом с семейством Qwen и платформой Model Studio. Материалы вендоров можно почитать на странице Seedance от ByteDance Seed и на сайте проекта Wan.

Для разработчика родословная важна меньше, чем путь доступа. Обе модели сначала обучаются и хостятся в Китае, что исторически означало отдельные консоли, отдельный биллинг и верификацию по номеру телефона, которая не всегда принимает иностранный номер. Маршрутизация через шлюз ofox схлопывает это в один ключ и один эндпоинт, и это практическая причина, почему это сравнение о моделях, а не о бумажной волоките. Интересное решение это цена и возможности, а не то, в какую консоль вы можете войти.

Эта рамка также задаёт честный предел спецификации. ByteDance и Alibaba обе настраиваются под свои домашние платформы, так что стиль движения, темп по умолчанию и интерпретация промптов отличаются способами, которые таблица не улавливает. Единственный способ это увидеть, прогнать один и тот же промпт через обе, чем и займётся следующий раздел.

Тест на одном промпте: что покупает разрыв в цене

Цена и таблицы спеков решают лёгкую часть. Более трудный вопрос, держится ли более дешёвая модель на движении, следовании промпту и синхронизации звука. Паритет спеков не значит паритет вывода, так что этот раздел прогоняет один и тот же промпт через оба флагмана и сравнивает результат, а не доверяет таблице.

Тестовый промпт один, зафиксирован одинаковым для обеих моделей, 1080p, 16:9, 8 секунд, звук включён:

“A ceramic coffee cup on a wooden table, morning light from a window, steam rising, a hand enters frame and lifts the cup. Ambient cafe sound.”

Четыре кадра из одного промпта с кофейной чашкой: Seedance 2.0 в верхнем ряду, Wan 2.7 в нижнем, оба в 1080p

Один промпт, четыре кадра на модель: Seedance 2.0 (сверху) и Wan 2.7 (снизу). Оба отрисовывают чашку, пар и тёплый свет из окна; следите за рукой на четырёх кадрах.

Те же два клипа в движении, рядом: Seedance 2.0 (слева), Wan 2.7 (справа), зациклены и без звука. На стороне Seedance рука входит в кадр и поднимает чашку; на стороне Wan чашка и пар держатся, но подъём почти не читается.

КритерийSeedance 2.0Wan 2.7Заметки
Следование промпту (объекты, действие)Полное, рука входит и поднимает чашкуЧастичное, чашка и пар есть, подъём почти не читаетсяДействительно ли рука поднимает чашку
Связность движения (без искажений)Чисто по всем четырём кадрамЧисто по всем четырём кадрамФизика пара и руки по кадрам
Уровень звука (измерено)Полная синхронная дорожка, ~-34 dB сред. / -5 dB пикЕсть, но слабый, -43 dB сред. / -30 dB пикОбе выдают синхронную аудиодорожку; у Wan она примерно на 9 dB тише на этом клипе
Текущая оценка вывода (8 с, 1080p)$2.72$1.208 × USD/s

Строка стоимости — текущая оценка text-to-video для 8 секунд вывода в 1080p по тарифам каталога, а не счёт за исторические образцы: Seedance $2.72 против Wan $1.20. По текущему предложению основного провайдера BytePlus оценка Seedance составляет $2.48. Исходные наблюдения по образцам не изменены.

Один спокойный промпт не нагружает видеомодель, так что честному тесту нужен ещё и промпт с активным движением, где более дешёвые модели обычно ломаются. Тестовый промпт два, те же настройки:

“A skateboarder does a kickflip down a set of stairs, fast camera pan, crowd in the background, daytime.”

Четыре кадра из промпта со скейтбордическим кикфлипом: Seedance 2.0 в верхнем ряду, Wan 2.7 в нижнем

Промпт с активным движением: Seedance 2.0 (сверху) держит доску, ноги и толпу на фоне связными на всём трюке; Wan 2.7 (снизу) сохраняет общие планы, но уходит в искажённый крупный план в середине последовательности.

Движение рассказывает историю, которую не расскажут стоп-кадры: Seedance 2.0 (слева), Wan 2.7 (справа), зациклены. На стороне Seedance доска и ноги остаются зафиксированными на всём флипе, тогда как сторона Wan срывается в искажённый крупный план на полпути, прежде чем восстановить общий план.

Это тот промпт, что разводит уровни. Быстрое движение камеры плюс трюк с твёрдым телом плюс толпа на фоне это место, где вылезают искажения, дублирование конечностей и дрейф физики. Оцените оба клипа по тому, остаются ли доска и ноги связными на всём флипе и размазывает ли панорама фон. Прогоните оба промпта на bytedance/seedance-2.0 и alibaba/wan-2.7 и посмотрите два клипа рядом, прежде чем завязывать конвейер на любую из моделей. Более длинные клипы усиливают эффект: на 15 секундах небольшой покадровый дрейф накапливается, так что если ваш формат длинный, тестируйте на реальной длительности, а не на безопасном 5-секундном сэмпле.

Асинхронный воркфлоу: submit, poll или webhook

Генерация видео это не единый блокирующий запрос, как chat completion. Вызов ofox POST /v1/videos возвращается сразу с 202 Accepted и polling_url. Клип рендерится в фоне, и вы узнаёте, что он готов, одним из двух способов: опрашиваете задачу или регистрируете webhook.

Задача проходит через небольшой конечный автомат. Вы либо продолжаете проверять, либо получаете обратный вызов, пока она не достигнет терминального состояния.

ofox /v1/videos async task state machineAsync task lifecycleOne POST /v1/videos, then poll or webhook until a terminal state202 Accepted+ polling_urlpendingqueuedprocessingrenderingDELETETTLcompleteddownload clipfailedread error, retrycancelledyou stopped itexpiredTTL elapsed, regenterminal states — polling stops here

Задача проходит через три активных состояния, затем останавливается на одном из четырёх терминальных. Опрашивайте GET /v1/videos/{id} или регистрируйте webhook; DELETE отменяет, а результаты истекают по TTL.

Поле / состояниеЗначениеЧто делать
202 + polling_urlЗадача принята, рендер началсяСохраните URL, начните опрос
status: pendingВ очереди, не начатаПродолжайте опрос, не чаще 1/с
status: processingРендер идётПродолжайте опрос
status: completedГотово, приложен URL результатаСкачайте клип
status: failedОшибка генерацииЧитайте error, повтор или запасной вариант
status: cancelledВы вызвали DELETEОстановитесь
status: expiredTTL результата истёкСгенерируйте заново

Две операционные детали избавят вас от тикета в поддержку. Во-первых, опрашивайте не чаще одного раза в секунду; эндпоинт GET /v1/videos/{id} защищён рейт-лимитом, и плотный цикл словит троттлинг. Во-вторых, для прода обычно нужен webhook вместо опроса. Передайте callback_url при создании задачи, и ofox пришлёт HMAC-подписанный payload, когда клип завершится. URL должен быть HTTPS и публичным: приватные, loopback- и cloud-metadata-адреса отклоняются SSRF-валидацией, а плохой адрес падает на этапе создания с 400 invalid_callback_url. Если нужно прервать прогон, DELETE /v1/videos/{id} отменяет его. Всё это идентично для Seedance и Wan, в чём и суть: операционная поверхность не меняется при смене модели.

Частые ошибки и подводные камни

Большинство сбоев с обеими моделями идут из одной и той же горстки несоответствий, а не из самих моделей.

СимптомПричинаИсправление
400 на клипе 2–3 с с SeedanceМинимальная длительность Seedance это 4 сВозьмите Wan (планка 2 с) или поднимите длительность до 4 с
Разрешение отклонено на Fast / MiniFast и Mini ограничены 720pЗапросите 720p или используйте флагман bytedance/seedance-2.0 для 1080p / 4K
400 invalid_callback_urlWebhook не HTTPS или указывает на приватный адресИспользуйте публичный HTTPS-эндпоинт
Задача бесконечно в опросеСлишком частый опрос ловит троттлинг, или игнорируются терминальные состоянияОпрос ≤1/с, выход на completed / failed / cancelled / expired
Получили t2v, а хотели i2vВ payload нет изображенияПередайте frame_images (или input_references), чтобы включить режим изображения
Неожиданное соотношение сторонУ Wan нет опции adaptiveЗадайте явное соотношение; adaptive поддерживает только Seedance

Поведение с выводом режима это то, что удивляет людей. Эндпоинт не принимает флаг mode; он читает ваш payload. Нет изображений значит text-to-video, frame_images значит изображение или первый/последний кадр, а input_references значит по референсу. Это держит форму вызова одинаковой у обоих семейств моделей, но также значит, что забытое поле изображения молча выдаёт вам не тот режим вместо ошибки.

Промптинг и звук: практические заметки

Ни одной модели не нужен особый диалект промптов, но несколько привычек поднимают попадание на обеих. Для text-to-video описывайте субъект, действие, камеру и обстановку отдельными предложениями, а не одной сплошной фразой; оба семейства парсят “что, делает что, как снято, где” надёжнее, чем стену прилагательных. Держите действие единичным. Промпт, который просит кикфлип, реакцию толпы и блик объектива за восемь секунд, обычно выдаёт одно из трёх, так что если нужны все три, сцепляйте более короткие клипы вместо перегруза одной генерации.

Звук включён по умолчанию на каждом уровне здесь, и это меняет то, как вы пишете. Поскольку обе модели генерируют синхронную аудиоподложку, промпт, упоминающий “ambient cafe sound” или “footsteps on gravel”, получает подходящую дорожку, тогда как промпт, который ничего не говорит про звук, получает то, что модель додумает, а это не всегда то, что вам нужно. Назовите звук, который ожидаете, иначе унаследуете догадку. Если вы сводите клип в таймлайн со своим саунд-дизайном, эта сгенерированная подложка это шум, который придётся вычищать, так что относитесь к звуку как к решению, а не как к бесплатному бонусу.

Для image-to-video переданный кадр важнее промпта. Чистый первый кадр в высоком разрешении с уже собранной композицией субъекта даёт обеим моделям стабильный якорь, и тогда промпту остаётся только описать движение: “slow push in”, “hair moves in the wind”, “camera orbits left”. Соотношение сторон adaptive у Seedance здесь помогает, потому что оно может подстроиться под кадр, который вы передаёте, вместо принудительного кропа, а значит одно референсное изображение может гнать вывод в 16:9 и в 9:16 без перекадрирования. Wan нужно явное соотношение, так что планируйте кроп до отправки.

Расчёт бюджета с учётом разрешения

Таблица оценивает 2 000 результатов text-to-video по 5 секунд без входного видео и повторных попыток. Mini и Fast используют 720p, остальные строки — 1080p, поэтому это не четыре варианта одинакового результата. Это бюджетный пример, а не фактический счёт.

Модель / разрешениеКаталог USD/s5 с по каталогу2 000 по каталогуОсновной провайдер USD/s2 000 по предложению
Seedance 2.0 Mini / 720p$0.08$0.40$800$0.04 (Volcengine)$400
Seedance 2.0 Fast / 720p$0.13$0.65$1,300$0.091 (Volcengine)$910
Seedance 2.0 / 1080p$0.34$1.70$3,400$0.31 (BytePlus)$3,100
Wan 2.7 / 1080p$0.15$0.75$1,500$0.15 (Aliyun)$1,500

При одинаковом 1080p Seedance 2.0 дороже Wan на $1,900 по каталогу или на $1,600 по предложениям основных провайдеров. Если сначала создать 2 000 черновиков Mini в 480p, а затем отдельно 200 финальных клипов Seedance 2.0 в 1080p, оценка по каталогу равна 2,000 × 5 × $0.04 + 200 × 5 × $0.34 = $740; по предложениям провайдеров — $200 + $310 = $510. Отобранные черновики тоже оплачиваются: нельзя считать только отброшенные.

По тарифам каталога для text-to-video 1080p результат длительностью 5 секунд стоит $1.70 у Seedance 2.0 и $0.75 у Wan 2.7; 15 секунд — $5.10 и $2.25. Для Seedance 2.0 в 4K тариф каталога — $1.37/s, предложение основного провайдера BytePlus — $1.24/s. Входное видео может изменить и тариф, и оплачиваемую длительность; эти оценки для текстового входа нельзя переносить на video-to-video.

Когда выбирать Seedance 2.0

Тянитесь к Seedance 2.0, когда важны и объём, и разрешение. Трёхуровневая структура позволяет подгонять стоимость под качество для каждой задачи вместо оплаты по одной плоской ставке: Mini для одноразовых вариантов и черновиков, Fast для одобренного вывода 720p, флагман для hero-клипов, которым нужен 1080p или 4K. Поскольку все три делят один префикс ID модели и один эндпоинт, вы можете маршрутизировать по уровню внутри своего кода, не трогая авторизацию. Если Seedance уже выбран и остался только вопрос уровня, Seedance 2.0: Mini, Fast или флагман разбирает этот выбор по каждому разрешению.

Это правильный дефолт для товарного видео в e-commerce, рекламных вариантов для соцсетей и любого конвейера, где вы генерируете сотни или тысячи коротких клипов и итерируете. Потолок 4K на флагмане также значит, что вы не перерастёте его в тот момент, когда клиент попросит мастер в более высоком разрешении. Соотношение сторон adaptive здесь тоже тихое удобство: для смешанной ленты из размещений 16:9, 9:16 и 1:1 вы можете дать модели подогнать кадр вместо поддержки трёх вариантов промпта.

Где кусает: ничего короче 4 секунд, а дешёвые уровни упираются в 720p. Если весь ваш бизнес это 2-секундные лупы или вывод минимум в 1080p на бюджете, математика уровней перестаёт помогать.

Когда выбирать Wan

Выбирайте Wan 2.7, когда клип короткий или когда вы уже вложились в стек Alibaba. Минимальная длительность в 2 секунды это настоящая возможность, которой у Seedance нет, и для лупов, стингеров и микропереходов эта планка решающий фактор, а не ставка. Wan 2.7 также добавляет video-to-video, которого нет у Wan 2.6, так что используйте 2.7, если вы продлеваете или перестилизуете существующий материал.

Настройка промптов, референсы и QA тоже влияют на выбор. Сравнивайте одинаковые требования к результату и включайте в бюджет миграцию и неудачные генерации.

Когда НЕ выбирать ни одну (и что использовать вместо)

Ни Seedance, ни Wan не ответ для каждой задачи.

  • Для говорящего аватара: HappyHorse 1.1 стоит по каталогу $0.14/s в 720p и $0.18/s в 1080p. Сначала проверьте поддерживаемые входные данные и требования к результату.
  • Вам нужен фотореализм для западного рынка в объёме, или конкретно Sora и Veo. Они работают на своих нативных API, а не на /v1/videos. Мы сравнивали их в сравнении API генерации AI-видео: Sora 2 Pro против Veo 3.1 против Kling 2.6 Pro, где вывод был противоположен этому посту: три модели, три отдельных SDK, ни одного общего эндпоинта. Если Kling конкретно в вашем списке, гайд по видео API Kling 2.6 Pro разбирает его от и до.
  • Ваша задача это изображение, а не видео. Для стоп-кадров image-собрат от ByteDance разобран в Seedream 4.5 Doubao Image API.

Попробуйте обе через ofox: A/B на одном эндпоинте в 10 строках

Вот где Seedance vs Wan перестаёт быть спором о спеках. Поскольку обе живут за ofox POST /v1/videos, вы переключаете модели, правя строку model. Вызов асинхронный, ровно как описано выше: отправляете, получаете polling_url, опрашиваете до completed.

Для пробы text-to-video в низком разрешении bytedance/seedance-2.0-mini стоит $0.04/s в 480p по каталогу; предложение основного провайдера Volcengine на 16 сентября — $0.02/s. Запросы оплачиваются: это не бесплатный тест.

A/B обеих моделей на Python

import os, time, requests

OFOX = "https://api.ofox.run/v1"
HEAD = {"Authorization": f"Bearer {os.environ['OFOX_API_KEY']}"}

def generate(model, prompt):
    r = requests.post(f"{OFOX}/videos", headers=HEAD, json={
        "model": model,
        "prompt": prompt,
        "duration": 8,
        "resolution": "1080p",
        "aspect_ratio": "16:9",
    })
    r.raise_for_status()
    poll = r.json()["polling_url"]        # 202 + polling_url
    while True:
        s = requests.get(poll, headers=HEAD).json()
        if s["status"] in ("completed", "failed", "cancelled", "expired"):
            return model, s
        time.sleep(2)                     # poll no faster than 1/s

prompt = "A ceramic coffee cup on a wooden table, morning light, steam rising."
for model in ("bytedance/seedance-2.0", "alibaba/wan-2.7"):
    print(*generate(model, prompt))       # swap the string, same call

Тот же вызов на Node

const OFOX = "https://api.ofox.run/v1";
const HEAD = { Authorization: `Bearer ${process.env.OFOX_API_KEY}`,
               "Content-Type": "application/json" };

async function generate(model, prompt) {
  const res = await fetch(`${OFOX}/videos`, {
    method: "POST", headers: HEAD,
    body: JSON.stringify({ model, prompt, duration: 8,
                           resolution: "1080p", aspect_ratio: "16:9" }),
  });
  let { polling_url } = await res.json();          // 202 + polling_url
  while (true) {
    const s = await (await fetch(polling_url, { headers: HEAD })).json();
    if (["completed", "failed", "cancelled", "expired"].includes(s.status))
      return { model, s };
    await new Promise(r => setTimeout(r, 2000));   // poll no faster than 1/s
  }
}

const prompt = "A ceramic coffee cup on a wooden table, morning light, steam rising.";
for (const model of ["bytedance/seedance-2.0", "alibaba/wan-2.7"])
  console.log(await generate(model, prompt));      // one string swaps the model

Image-to-video: тот же вызов, добавьте кадр

Чтобы гнать любую модель от стоп-кадра, передайте frame_images вместо опоры на один промпт. Эндпоинт читает payload и переключается на image-to-video без другого маршрута:

r = requests.post(f"{OFOX}/videos", headers=HEAD, json={
    "model": "bytedance/seedance-2.0",
    "prompt": "camera slowly pushes in, steam rises",
    "frame_images": ["https://example.com/first-frame.png"],
    "duration": 8,
    "resolution": "1080p",
})

Два семейства моделей, одна авторизация, одна схема. Вот практическая причина гонять их в A/B, а не выбирать по таблице.

FAQ

Seedance 2.0 дешевле, чем Wan? Не в 1080p. Для text-to-video тариф каталога Seedance 2.0 — $0.34/s, Wan 2.7 — $0.15/s. Оценка для 5 секунд вывода составляет $1.70 против $0.75. Основной провайдер Seedance, BytePlus, предлагает $0.31/s, то есть $1.55 за 5 секунд, что тоже дороже Wan. Mini и Fast — отдельные модели с пределом 720p.

Какой ID модели у Seedance 2.0 в ofox? bytedance/seedance-2.0, bytedance/seedance-2.0-fast и bytedance/seedance-2.0-mini. Wan это alibaba/wan-2.7 и alibaba/wan-2.6.

Поддерживает ли Seedance 2.0 4K? Флагманский уровень bytedance/seedance-2.0 указывает 4K. Fast и Mini ограничены 720p, а Wan ограничен 1080p.

Могут ли обе генерировать звук? Да. Все уровни Seedance 2.0 и обе версии Wan указывают синхронный звук. Wan начинается с минимума в 2 секунды, Seedance с 4 секунд.

Нужны ли отдельные API-ключи? Нет. Обе работают через один ключ ofox и POST /v1/videos. Смена модели это замена одной строки.

Что лучше для image-to-video? Обе указывают i2v. Seedance добавляет v2v на всех трёх уровнях; Wan 2.7 добавляет v2v, Wan 2.6 нет.

Какая самая дешёвая видеомодель в ofox прямо сейчас? Для черновиков в низком разрешении можно рассмотреть Seedance 2.0 Mini. Тариф каталога для text-to-video: $0.04/s в 480p и $0.08/s в 720p. На 16 сентября основной провайдер Volcengine предлагает $0.02/s и $0.04/s соответственно. Это не единая ставка для любых режимов.

Проверенные источники

Часто задаваемые вопросы

Seedance 2.0 дешевле, чем Wan?
Не в 1080p. Для text-to-video тариф каталога Seedance 2.0 — $0.34/s, Wan 2.7 — $0.15/s. Оценка для 5 секунд вывода составляет $1.70 против $0.75. Основной провайдер Seedance, BytePlus, предлагает $0.31/s, то есть $1.55 за 5 секунд, что тоже дороже Wan. Mini и Fast — отдельные модели с пределом 720p.
Какой ID модели у Seedance 2.0 в ofox?
bytedance/seedance-2.0 для флагманского уровня, bytedance/seedance-2.0-fast и bytedance/seedance-2.0-mini. Wan это alibaba/wan-2.7 и alibaba/wan-2.6. Все пять работают через один эндпоинт POST /v1/videos, так что переключение это замена одной строки.
Поддерживает ли Seedance 2.0 видео 4K?
Флагманский уровень bytedance/seedance-2.0 указывает 480p, 720p, 1080p и 4K. Уровни Fast и Mini ограничены 720p. Wan 2.6 и 2.7 ограничены 1080p. Если 4K нужен из коробки, из этих двух его выдаёт только флагманский Seedance 2.0.
Могут ли Seedance 2.0 и Wan генерировать звук?
Оба могут. Seedance 2.0 (все три уровня) и Wan 2.6 / 2.7 указывают supports_audio: true, так что вы получаете синхронный звук без отдельного прогона озвучки. Минимальная длина клипа отличается: Wan начинается с 2 секунд, Seedance с 4 секунд.
Нужны ли отдельные API-ключи для Seedance и Wan?
Нет. Обе модели работают за одним ключом ofox и одним эндпоинтом (POST /v1/videos). Вы отправляете model, prompt, duration, resolution и aspect_ratio, получаете 202 с polling_url, затем опрашиваете GET /v1/videos/{id}, пока status не станет completed. Смена модели это правка поля model.
Что лучше для image-to-video?
Обе указывают i2v. Seedance 2.0 также указывает video-to-video на всех трёх уровнях; Wan 2.7 добавляет v2v, а Wan 2.6 нет. Для прогонов по первому кадру или по референсу схема ofox /v1/videos определяет режим по тому, передаёте ли вы frame_images или input_references, так что форма вызова у обеих моделей одинакова.
Какой самый дешёвый способ генерировать AI-видео в 2026?
Для черновиков в низком разрешении можно рассмотреть Seedance 2.0 Mini. Тариф каталога для text-to-video: $0.04/s в 480p и $0.08/s в 720p. На 16 сентября основной провайдер Volcengine предлагает $0.02/s и $0.04/s соответственно. Это не единая ставка для любых режимов.