
Black Forest Labs выпустила Flux 3 Image, “картиночную” часть семейства Flux 3. Что внутри:
раскладка сцены через заданные участки (bounding boxes);
многошаговое редактирование объектов, которое не трогает остальное изображение;
до 10 референсов;
генерация до 4K.
FLUX 3 появился 23 июля 2026 года как первая нативно мультимодальная модель Black Forest Labs: изображение, видео, аудио и предсказание действий для роботов обучались в одной архитектуре.
Первым до публики дошло видео. В начале августа Flux 3 Video стал общедоступным через API BFL и партнёров: клипы до 20 секунд в HD и Full HD с нативным звуком и диалогами с липсинком более чем на 14 языках.
Теперь пришла очередь картинок: 1 октября вышел Flux 3 Image. Он умеет text‑to‑image и image‑to‑image, хорошо рисует текст и фотореализм.
Что умеет Flux 3 Image





1. Раскладка сцены рамками
Главная идея: вы не просите нейросеть «как‑нибудь расставить» объекты, а сами рисуете для каждого элемента прямоугольник и описываете, что в нём должно быть.
Рисовать боксы вручную необязательно. Есть режим для ИИ‑агентов: LLM сама планирует раскладку по одной строке и соотношению сторон, а вы двигаете то, что не понравилось.
2. Редактирование
Каждый бокс можно переописать, заменить или переместить. Всё нетронутое остаётся как было.
Картинка выдерживает серию правок подряд и не плывёт.
3. До десяти референсов в одном кадре
Референсы получают имена ref_image_0, ref_image_1 и так далее, в порядке добавления. В промпте можно ссылаться на них.
4. Нативные 4K
Максимальный размер в демо 5456×3072 пикселей (около 16,8 МП). BFL показывает, что мелочи вроде рукописных символов на вывеске высотой порядка 225 px или текста на бумажном фонарике читаются при зуме.
Доступ и цены
Модель уже появилась:
на официальном сайте Black Forest Labs;
на нашей ИИ‑платформе.
Версию с открытыми весами обещают в ближайшие недели.


