FLUX 3 - новая модель Black Forest Labs, тех же авторов FLUX.1, и это уже не «ещё одна нейросеть для картинок». Одна архитектура сразу рисует и редактирует изображения, а также собирает видео до 20 секунд с нативным звуком. Разбираем, что реально умеет FLUX 3, чем отличается от FLUX.1 и как попробовать её из России
Модель анонсировали в июле 2026. Главная идея - мультимодальность из общего ядра: картинка, видео и аудио считаются одной сетью, а не тремя отдельными. Ниже - возможности по пунктам, честное сравнение с прошлой версией и сценарии, кому она нужна
- FLUX 3 - мультимодальная модель Black Forest Labs: в одной архитектуре картинки, видео и звук
- Видео до 20 секунд за одну генерацию с нативным синхронным аудио - звук считается вместе с картинкой
- Режимы видео: текст-в-видео, фото-в-видео, видео-в-видео, управление по ключевым кадрам и продолжение клипа
- Картинки и редактирование фото никуда не делись - модель по-прежнему сильна в статике
- На старте - ограниченный доступ; открытые веса FLUX 3 Dev обещаны позже в 2026
- Попробовать из России можно через агрегатор Syntax AI, оплата картами РФ
Что такое FLUX 3
FLUX 3 - это мультимодальная генеративная модель от Black Forest Labs, немецкой команды, которая раньше сделала популярную линейку FLUX.1. Новизна в том, что изображение, видео и звук здесь генерирует одна сеть с общим ядром, а не набор отдельных моделей, склеенных в интерфейсе
На практике это значит, что FLUX 3 понимает сцену целостно: та же модель, что рисует кадр, умеет его оживить и озвучить. По заявлению разработчика, это первый крупный релиз, где текст-в-видео и синхронный звук работают из одного backbone, а не подкладываются постпроцессом
Важная оговорка честности: на старте FLUX 3 выходит в ограниченном доступе. Часть режимов раскатывается постепенно, поэтому конкретный набор функций у разных провайдеров и на разных этапах может отличаться. Ниже описываем возможности так, как их заявил разработчик
Что нового по сравнению с FLUX.1
Коротко: FLUX.1 был про картинки, FLUX 3 - про картинки плюс движущуюся сцену со звуком. Это не косметический апдейт, а смена класса модели
- Видео. Раньше FLUX генерировал только статику. Теперь модель делает клипы до 20 секунд с движением и озвучкой
- Звук. Аудио не отдельным сервисом, а нативно и синхронно с картинкой - это редкость среди видеомоделей
- Управление. Появился контроль по ключевым кадрам и генеративное продолжение видео, то есть можно задать опорные точки и дорастить сцену
- Единое ядро. Одна модель на несколько модальностей упрощает связку «нарисовал - оживил - озвучил» без прыжков между сервисами
При этом сильные стороны FLUX никуда не ушли: чёткая геометрия, аккуратный текст в кадре и предсказуемая композиция. Если вам нужна только картинка, FLUX 3 остаётся крепким выбором в статике
Видео со звуком до 20 секунд
Главная витрина FLUX 3 - видео. По данным разработчика, модель генерирует клипы длиной до 20 секунд за одну генерацию, и это заметно больше привычных 5-8 секунд у многих конкурентов. Плюс звук считается вместе с изображением, а не накладывается вторым проходом
Заявленные режимы работы с видео:
- Текст-в-видео - клип из текстового промпта с нуля
- Фото-в-видео - оживление статичного кадра или своего снимка
- Видео-в-видео - пересборка и стилизация готового ролика
- Ключевые кадры - задаёте опорные точки, модель достраивает движение между ними
- Продолжение - генеративное дорастание видео и звука дальше по таймлайну
Для коротких роликов, анимаций и соцсетей это удобно: 20 секунд со звуком - почти готовый Reels или тизер без сборки в редакторе. Учтите только, что видео тяжелее картинки по ресурсам, поэтому расходует больше токенов
Картинки и редактирование
FLUX 3 остаётся полноценным генератором изображений и умеет их редактировать. Это важно: апгрейд не отобрал у модели то, за что любили FLUX.1, а добавил сверху видео и звук
В статике модели линейки FLUX традиционно сильны в трёх вещах: чистая геометрия и перспектива, читаемый текст на вывесках и упаковке, аккуратная композиция без типичных артефактов. Для дизайна, мокапов и предметных кадров это ценно - меньше кривых надписей и «поплывших» деталей
Продвинутое редактирование означает, что можно менять части картинки по промпту: заменить фон, поправить объект, собрать вариацию. По сути это связка «сгенерировал - тут же отредактировал» внутри одной модели
Шаг в физический ИИ
Отдельная любопытная деталь: FLUX 3 - первый заход Black Forest Labs в физический ИИ. У модели есть вариант для предсказания действий, и по сообщениям его уже тестируют на производственных линиях Audi
Для контентмейкера это пока не про повседневные задачи, но показывает вектор: та же архитектура, что генерирует видео, учится предсказывать движение в реальном мире. Нам из этого интересна сама модель для картинок и роликов, а роботы - скорее знак, куда идёт индустрия
FLUX.1 против FLUX 3
Сжатое сравнение поколений - что изменилось на переходе от FLUX.1 к FLUX 3. Колонка новой модели выделена
| Параметр | FLUX.1 | FLUX 3 |
|---|---|---|
| Модальности | картинки | картинки + видео + звук |
| Видео | нет | до 20 сек со звуком |
| Звук | нет | нативный, синхронный |
| Редактирование фото | базовое | продвинутое |
| Управление | промпт | промпт + ключевые кадры |
| Сильная сторона | геометрия, текст в кадре | та же статика + движение |
| Открытые веса | да (dev-версии) | обещаны позже в 2026 |
Кому и зачем нужна FLUX 3
Модель широкая, поэтому проще смотреть по сценарию - кто узнаёт свою задачу
- Контентмейкеру и SMM - короткие ролики со звуком под Reels, Shorts и сторис без монтажа
- Дизайнеру - картинки с чистой геометрией и текстом плюс быстрые правки в одной модели
- Тем, кто оживляет фото - режим фото-в-видео с готовой озвучкой прямо из промпта
- Малому бизнесу - тизеры и промо-клипы под товар без студии и подрядчика
- Тем, кто любит эксперименты - видео-в-видео и продолжение сцены как поле для приёмов
Если задача - только статичная картинка, можно оставаться на привычных моделях. FLUX 3 раскрывается там, где нужна связка кадр плюс движение плюс звук в одном месте
Как попробовать в России
FLUX 3 стартует в ограниченном доступе, и удобнее всего дойти до неё через сервис-агрегатор. Syntax AI (Синтакс АИ) собирает FLUX 3 и ещё 100+ нейросетей под одной подпиской, работает из России и принимает карты РФ через СБП и МИР - без плясок с зарубежными платежами
Плюс агрегатора именно для новой модели в том, что рядом лежат альтернативы. Один промпт можно прогнать во FLUX 3, Seedance и Kling и выбрать, кто лучше справился с вашей сценой. Сколько стоит доступ и что входит в пакеты - на странице тарифы Syntax AI
Запуск - на сайте через браузер или в Telegram-боте со смартфона. Регистрация бесплатная, сразу начисляются пробные токены: их хватает попробовать генерацию картинок. Видео и тяжёлые правки расходуют больше токенов, поэтому под них нужен платный пакет. Токены не сгорают, так что тестировать можно в своём темпе