«Реальность не обманешь»: авторы FLUX выпустили модель, которая видит, слышит и двигает роботами

Black Forest Labs представила FLUX 3 — единую модель для картинок, видео, звука и управления роботами; оценка $3,25 млрд.

Aravana··1 мин

🔴 «Реальность не обманешь»: авторы FLUX выпустили модель, которая видит, слышит и двигает роботами

Немецкая лаборатория Black Forest Labs (та самая, чьи генераторы картинок FLUX стоят под капотом у доброй половины ИИ-редакторов) представила FLUX 3. Это уже не просто рисовалка: одна модель одновременно работает с изображением, видео, звуком и «действием», то есть предсказывает движения для роботов.

«Реальность не обманешь. Модель, которая училась только на картинках, только картинки и умеет создавать», так объясняет идею сооснователь и гендиректор Робин Ромбах. В ранних тестах FLUX 3 Video уже обходит ведущие видеомодели, особенно в мимике лица и в синхронизации звука с тем, что происходит на экране.

Под новую модель компанию оценили в $3,25 млрд, а инвесторы (среди них a16z, NVIDIA, Salesforce, Adobe и Canva) вложили более $450 млн. Но интереснее всего часть про роботов: по словам техдиректора mimic robotics Элвиса Навы, робот теперь осваивает новую задачу за 30 минут данных вместо прежних 30 с лишним часов, «схватывает за минуты, а не за дни».

Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.

#нейросети #модели #мультимодальность #роботы #робототехника #физическийИИ #воплощённыйИИ #автоматизация #ИИ #технологии #AravanaAI

Тип материала: Пост из Telegram

Поделиться:TelegramXLinkedIn
Как вам материал?

Хотите получать подобные материалы раньше?

Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.

Узнать про Intelligence

Не пропускайте важное

Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.

Похожие материалы

Китайский HiDream.ai стал юникорном за три месяца: 1,5 млрд юаней на «модели мира»

Пекинский стартап HiDream.ai закрыл третий за три месяца раунд — Series C на 1,5 млрд юаней (около $210 млн) — и вошёл в клуб юникорнов, строя нативные омнимодальные модели мира.

·1 мин

Meta научила своего AI-ассистента не думать, а делать

Обычным пользователям открыли Meta AI на Muse Spark 1.1, который выполняет задачи.

·1 мин

Samsung ведёт переговоры о €1 млрд в Mistral при оценке €20 млрд

Samsung обсуждает вложение до €1 млрд (около $1,1 млрд) в Mistral при оценке €20 млрд — почти вдвое выше прошлогодней.

·1 мин