
Компания Black Forest Labs представила FLUX 3 — мультимодальную ИИ-модель, обученную на изображениях, видео и аудио. В начале компания предоставила ранний доступ к FLUX 3 Video — модели, способной генерировать видео с сопровождающим звуком.
Доступ к модели предоставляется по заявкам, при этом учитываются задачи пользователя или организации. Более детальную информацию о новой модели можно найти в материале Postium.
Также читайте: 7 лучших нейросетей для видео генерации
Функционал нейросети FLUX 3 Video
FLUX 3 Video может создавать видео со звуком длительностью до 20 секунд на один запрос. Модель принимает текстовые команды, изображения и исходные видеоролики.

Пользователи могут анимировать исходный кадр, использовать изображение в качестве визуального референса, переносить персонажей или другие ключевые элементы из исходного видео в новую сцену, продолжать видео с учетом звука или задавать ключевые кадры для переходов между сценами. Модель поддерживает многоязычные диалоги, различные пропорции и анимированный текст. Последовательная генерация нескольких клипов позволяет создать более длинное видео.
Black Forest Labs также продемонстрировала результаты ранних испытаний. В сравнении 10-секундных видео в 720p со звуком участники чаще выбирали FLUX 3 по сравнению с Grok Imagine Video, Kling v3 Pro, Seedance 2.0, Gemini Omni Flash, Runway Gen-4.5 и Luma Ray 3.2.

FLUX 3 также обладает функциями создания и редактирования изображений. Доступ к FLUX 3 Image компания намерена открыть в ближайшие недели. В будущем Black Forest Labs планирует предоставить API и предоставить приватные веса для генерации и редактирования видео, аудио и изображений.

Как получить доступ и использовать нейросеть
На данный момент доступна лишь ранняя версия FLUX 3 Video. Для участия в тестировании необходимо заполнить заявку на веб-сайте Black Forest Labs. Компания бесплатно предоставляет доступ выбранным пользователям и оценивает заявки по описанию их планов по использованию модели.
Публичного API, цен и собственного интерфейса для FLUX 3 пока не существует. Black Forest Labs обещает открыть API и предоставить приватные веса для генерации и редактирования видео со звуком в ближайшие недели и месяцы. Позднее будет доступен отдельный ранний доступ к FLUX 3 Image.
После получения доступа пользователи смогут создавать видео длительностью до 20 секунд на основе текста, изображения, исходного видео или ключевых кадров. Модель генерирует звук одновременно с видео, продолжает исходный ролик и переносит персонажа или другой объект из референса в новую сцену.
Что меняется? Ранее линейка FLUX была сосредоточена на генерации и редактировании изображений. Теперь FLUX 3 интегрирует работу с видео, звуком и визуальными референсами в единой архитектуре. В дальнейшем компания планирует использовать эту архитектуру для прогнозирования действий роботов.
Напомним, предыдущая версия модели — FLUX.2 — была выпущена в ноябре 2025 года и была сосредоточена на генерации и редактировании изображений. С FLUX 3 компания расширила функционал: модель теперь работает не только с изображениями, но и с видео и звуком.
В области робототехники Black Forest Labs совместно с mimic robotics разработала модель FLUX-mimic на основе FLUX 3. По данным компании, её уже тестируют и внедряют в производственные процессы Audi.
Итог: В данный момент можно подать заявку только на ранний доступ к FLUX 3 Video. Доступ к FLUX 3 Image, API и открытым весам будет предоставляться поэтапно.


