Black Forest Labs представила FLUX 3 для видео и робототехники
🚀 Black Forest Labs представила FLUX 3 для видео и робототехники
Black Forest Labs выпустила FLUX 3 — мультимодальную модель, которая одновременно генерирует видео с аудио, анимирует изображения и предсказывает действия для роботов. По заявлению компании, она превосходит Seedance 2.0, Gemini Omni и Grok Imagine, но главное здесь — архитектура: один трансформер обучался на всех модальностях сразу, включая данные с носимых устройств и роботов-манипуляторов. Робототехнический вариант FLUX-mimic, построенный на той же основе, уже тестируют с Audi — политика открытых весов Dev-версии обещает доступ для сообщества в будущем. Модель способна работать на одном GPU без облачной инфраструктуры, что критически меняет экономику внедрения.
По данным Latent Space, запуск FLUX 3 совпал с анонсом ChatGPT Voice, но именно унификация модальностей в одной модели, включая управление оборудованием, задаёт более высокую планку. Это не просто очередной видеогенератор — это заявка на слой физического ИИ.
BFL не раскрыла параметры модели и не дала независимых тестов — пока всё держится на собственных замерах. Однако сам факт, что одна архитектура одинаково успешно делает кино и крутит роборуку, переопределяет спор о том, где заканчивается генеративный ИИ и начинается управление реальным миром.
#FLUX3 #BlackForestLabs #multimodal #robotics #openweights
Такие разборы выходят в канале каждый день — коротко и со ссылкой на первоисточник.