У другого AI-агрегатора дешевле? Снизим цену, переходите к нам
← Все статьиОбзоры AI-моделей

Seedance 2.0: модель, которая снимает так, будто это сосед снял на телефон

Артём Соколов2 августа 2026 г.Чтение займёт 9 мин
Flami blog

Что умеет Seedance 2.0 от ByteDance: нативный UGC «как с телефона», звук и видео в одной генерации, топ Artificial Analysis. Честно про плюсы и слабости.

Меня зовут Артём, я продуктовый инженер во Flami, и через мои руки проходят все видеомодели, что мы подключаем к подписке. Seedance я гонял дольше обычного, потому что не верил в одну штуку: что нейросеть может снять ролик, который выглядит не как «красивая нейросеть», а как будто сосед достал телефон и снял на кухне. Сел проверять. И вот тут, короче, она меня удивила.

Если в двух словах: когда мне нужна не глянцевая реклама, а честный UGC под карточку Wildberries, я теперь первой пробую Seedance.

Видео
Видео

Что это вообще и кто сделал

Seedance делает команда Seed внутри ByteDance, те самые, кто стоит за TikTok и CapCut. Версию 2.0 они официально выпустили 12 февраля 2026 года, сначала в Китае. Это не просто «видео по тексту». Это мультимодальная модель: на вход она ест текст, картинки, видео и аудио, причём всё сразу, в одной генерации.

Главное отличие от прошлой версии 1.5, по словам самих разработчиков, скачок в качестве сложных сцен и движений, плюс физика стала честнее. И ещё одна вещь, ради которой её и держат: звук генерируется не отдельно, а вместе с картинкой, в один проход.

Глобальную раскатку, кстати, притормозили из-за претензий Голливуда по авторским правам, поэтому в CapCut модель сначала открыли только в нескольких странах. Для нас, селлеров из РФ, это не особо важно, через Flami она доступна без всей этой географии.

Звук и картинка в одной генерации, а не клеёный voice-over

Вот это, на мой взгляд, и есть та фича, ради которой стоит вообще смотреть на Seedance.

Раньше как было. Модель рисует немое видео, а звук вы накладываете отдельно: voice-over, эмбиент, музыку. И почти всегда что-то не совпадает по таймингу, губы живут своей жизнью, шаги звучат не туда. Seedance генерирует аудио как часть того же прохода. По описанию ByteDance, модель выдаёт двухканальный звук с раздельными дорожками: фоновая музыка, эмбиент и голос персонажа, и всё это синхронно с движением в кадре.

На практике для селлера это значит вот что. Распаковка товара звучит правдоподобно: шуршит плёнка, щёлкает крышка, голос комментирует ровно тогда, когда руки делают движение. Не нужно потом сидеть в редакторе и подгонять foley вручную. Грубо говоря, ролик выходит из модели уже озвученным.

Честно говоря, я сначала думал, что это маркетинговая обёртка и звук будет резиновый. Погонял на распаковках и ASMR-формате, нет, lip-sync держит, шумы предметов на удивление натуральные. Хотя иногда аудио всё-таки плывёт, об этом ниже.

Откуда взялся весь хайп про топ лейдерборда

Цифра, с которой начинается разговор про Seedance в любом чате. На бенчмарках Artificial Analysis модель сейчас держит верхнюю строчку, и в text-to-video, и в image-to-video. Это блайнд-тест: людям показывают два ролика по одному и тому же промпту, не говоря, какая модель что сделала, и просят выбрать.

Прямо за ней, на втором месте, идёт HappyHorse 1.0 от Alibaba ATH. Дальше уже Kling 3.0, Veo 3.1 и остальные. То есть Seedance и HappyHorse сейчас делят топ-2, на конец апреля 2026-го расклад примерно такой.

Тут важно не обмануться. Лейдерборд меряет общее предпочтение «вообще», а не вашу конкретную задачу. Seedance выигрывает не потому, что она везде лучшая, а потому что хорошо собирает сложную сцену с движением, звуком и связным сюжетом. Для UGC под карточку этого с головой. Для кино-света премиум-уровня я бы всё равно посмотрел на Veo.

Что по характеристикам Seedance 2.0, давайте по цифрам

  • длина шота: 4–15 секунд;
  • разрешение: 480p, 720p, 1080p;
  • форматы: 16:9, 9:16, 1:1, 4:3, 3:4, 21:9;
  • вход: текст + до 9 картинок + до 3 видео + до 3 аудио;
  • звук: нативный, синхронный, с lip-sync.

Что тут стоит знать. Семь секунд про входные данные: можно скормить до девяти картинок и трёх видеороликов в один запрос. Вот она, та самая мультимодальность. По описанию ByteDance, модель умеет брать композицию из одной картинки, движение камеры из видео, а персонажа из другой картинки и собирать из этого новый ролик. Для брендовых креативов удобно: загрузили фото товара, задали стиль, получили видео, где товар не «уплывает» от кадра к кадру.

Нативное разрешение в первой версии было 480p и 720p, на нашей странице указаны режимы вплоть до 1080p. Шесть форматов закрывают всё: вертикаль 9:16 под Reels и TikTok, горизонталь под YouTube, квадрат под ленту. Длина до 15 секунд за один проход, причём это может быть многошотовый ролик, не один статичный план.

Многошотовый сюжет с одним героем

Вопрос, который мне чаще всего задают селлеры: «а можно сделать, чтобы в ролике был один и тот же человек в нескольких сценах, и он не менялся?»

С Seedance, в общем, да. Модель держит консистентного персонажа через несколько планов: герой берёт товар, разворачивает, выходит из кадра, и в следующем плане это всё ещё он, в той же одежде, с той же мимикой. ByteDance называет это «продолжить съёмку»: модель умеет дотягивать видео, добавлять следующий план по промпту, не теряя сцену.

Для отзыва-видео это золото. Раньше приходилось либо снимать живого человека, либо мириться с тем, что нейросетевой герой между кадрами превращается в другого. Тут один и тот же условный «покупатель» проходит весь сценарий: достал, попробовал, показал результат.

«Seedance 2.0 introduces new video editing capabilities, supporting targeted modifications to specified clips, characters, actions, and storylines.» — ByteDance Seed, анонс Seedance 2.0

Правда, сами разработчики честно пишут, что с мультисубъектной консистентностью (когда в кадре сразу несколько персонажей) ещё есть над чем работать. Так что на двух-трёх героев одновременно я бы пока не закладывался.

Где Seedance проседает, без прикрас

Тут разные тестеры говорят разное, но я выделю то, что сам вижу и что подтверждает ByteDance в собственном анонсе.

Первое, текст в кадре. Модель сама признаёт, что точность рендеринга текста ещё хромает. Если вам нужно, чтобы на упаковке читалась русская надпись или ценник, не факт, что выйдет с первого раза. Кириллица вообще болезненная тема почти у всех видеомоделей.

Второе, звук иногда искажается. Разработчики прямо пишут про «occasional audio distortion». На длинных репликах голос может поплыть, на коротких звуках всё ок.

Третье, гиперреализм и стабильность мелких деталей. На статике вблизи бывают артефакты, ByteDance это тоже отмечает как зону для доработки. Ну и про несколько героев в кадре я уже сказал.

Ещё момент про реальные лица. В CapCut ByteDance закрыл генерацию видео из изображений с настоящими лицами, это сделано из-за претензий по авторским правам и приватности. Плюс на ролики ставится невидимый водяной знак. Для селлера вывод простой: не надо пытаться «оживить» фото реального инфлюенсера без разрешения, делайте UGC на сгенерированных или лицензированных людях.

Под какие задачи селлера это реально берут

Не буду расписывать абстрактно, скажу по делу.

  • UGC-ролики для карточек WB и Ozon: «распаковка», «первое впечатление», «как пользуюсь». Та самая лоу-фай эстетика, которой верят.
  • Отзывы-видео с консистентным «покупателем» через несколько планов.
  • Рекламные креативы из ваших фото товара, с brand-консистентностью на каждом кадре.
  • Вертикальные клипы под Reels и Shorts, где первые секунды должны цеплять.

Один из наших клиентов, продавец товаров для дома, гонял на Seedance короткие распаковки под карточки. Сказал, что главное было не качество картинки даже, а что ролик «не пахнет нейросетью». Покупатель не должен чувствовать, что его обманывают глянцем.

Как Seedance стоит рядом с другими моделями

Вот моя рабочая шпаргалка, чисто по тому, кого беру первым под задачу:

  • UGC «как с телефона», звук в комплекте: Seedance 2.0;
  • эмоция, крупный план лица: Hailuo;
  • премиум-картинка, кино-свет: Veo 3.1;
  • динамика, движение камеры: Kling 3.0;
  • физика предметов в руках: Wan 2.7.

То есть Seedance это не «лучшая модель видео на все случаи». Это лучшая, когда нужен живой, озвученный, платформенно-родной ролик, который не выдаёт в себе генерацию. По эмоциональным крупным планам я всё равно скорее возьму Hailuo, а кому интересен второй номер лейдерборда, HappyHorse 1.0 лежит в том же окне.

Сколько стоит и где брать в РФ

Напрямую у ByteDance модель завязана на CapCut и Dreamina, с географией и зарубежной оплатой. Из России это боль.

У нас в Flami Seedance в общей подписке, тарификация в рублях. На тарифе Start фиксированный пакет кредитов, на Pro их больше и цена за ролик ниже, точные цифры в кабинете, потому что зависят от длины и качества. Главное, не нужно заводить аккаунт у ByteDance, воевать с оплатой и VPN. Seedance лежит в одном окне с Veo, Kling, Hailuo и остальными.

Чек-лист: брать ли Seedance

  • ✓ Нужен честный UGC «как с телефона» под карточку маркетплейса
  • ✓ Хотите звук синхронно с видео, без ручного наложения
  • ✓ Нужен один герой через несколько планов
  • ✓ Собираете креатив из своих фото товара
  • ✗ Нужна русская надпись в кадре читаемой, пока рискованно
  • ✗ В кадре сразу несколько персонажей, которые не должны путаться
  • ✗ Нужен максимальный кино-свет премиум-уровня, тут сильнее Veo

Что дальше

Хочу отдельно сравнить Seedance и HappyHorse на одинаковых UGC-промптах, раз уж они делят топ-2. И погонять мультимодальный вход поплотнее: насколько точно модель тащит персонажа из одной картинки в новую сцену. Но это уже другая статья.

Попробовать Seedance 2.0 без VPN и зарубежной карты можно в Flami, на стартовом пакете.

Источники

  1. ByteDance Seed: Seedance 2.0 Official Launch
  2. ByteDance Seed: страница модели Seedance 2.0
  3. TechCrunch: ByteDance's Dreamina Seedance 2.0 comes to CapCut
  4. Artificial Analysis: Text-to-Video Leaderboard
  5. Artificial Analysis: Image-to-Video Leaderboard
  6. Flami: продуктовая страница Seedance 2.0

Об авторе

Артём Соколов

Обозреватель Flami

Читайте также

Получите 15 кредитов бесплатно

Их можно потратить на генерацию изображений и видео:

≈ 11 х Nano Banana 2, ≈ 12 х GPT Image 2, ≈ 1 х Seedance 2

Получить кредиты бесплатно