«Реальность не обманешь»: авторы FLUX выпустили модель, которая видит, слышит и двигает роботами
Black Forest Labs представила FLUX 3 — единую модель для картинок, видео, звука и управления роботами; оценка $3,25 млрд.
🔴 «Реальность не обманешь»: авторы FLUX выпустили модель, которая видит, слышит и двигает роботами
Немецкая лаборатория Black Forest Labs (та самая, чьи генераторы картинок FLUX стоят под капотом у доброй половины ИИ-редакторов) представила FLUX 3. Это уже не просто рисовалка: одна модель одновременно работает с изображением, видео, звуком и «действием», то есть предсказывает движения для роботов.
«Реальность не обманешь. Модель, которая училась только на картинках, только картинки и умеет создавать», так объясняет идею сооснователь и гендиректор Робин Ромбах. В ранних тестах FLUX 3 Video уже обходит ведущие видеомодели, особенно в мимике лица и в синхронизации звука с тем, что происходит на экране.
Под новую модель компанию оценили в $3,25 млрд, а инвесторы (среди них a16z, NVIDIA, Salesforce, Adobe и Canva) вложили более $450 млн. Но интереснее всего часть про роботов: по словам техдиректора mimic robotics Элвиса Навы, робот теперь осваивает новую задачу за 30 минут данных вместо прежних 30 с лишним часов, «схватывает за минуты, а не за дни».
Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.
#нейросети #модели #мультимодальность #роботы #робототехника #физическийИИ #воплощённыйИИ #автоматизация #ИИ #технологии #AravanaAI
Хотите получать подобные материалы раньше?
Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.
Узнать про IntelligenceНе пропускайте важное
Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.