Xiaomi выдал 1000 токенов в секунду — быстрее, чем вы успеваете читать этот абзац

Xiaomi MiMo V2.5 Pro в режиме UltraSpeed выдаёт 1000 токенов/сек на стандартных GPU, в 10 раз быстрее базового.

Aravana··1 мин

🔴 Xiaomi выдал 1000 токенов в секунду — быстрее, чем вы успеваете читать этот абзац

Средний человек читает около 250 слов в минуту. Новый MiMo V2.5 Pro от Xiaomi в режиме UltraSpeed выдаёт примерно 110 слов в секунду. То есть модель пишет в двадцать с лишним раз быстрее, чем вы читаете. При этом работает на обычных GPU — без кастомных чипов.

Китайская команда разработала режим совместно с TileRT. UltraSpeed в 10 раз быстрее стандартного MiMo V2.5 Pro и более чем в шесть раз быстрее декабрьского MiMo V2 Flash (150 токенов/сек). Режим стоит втрое дороже базового варианта. Доступ — по заявкам для предприятий и профессиональных разработчиков с 9 по 23 июня.

Это первый раз, когда китайская лаборатория пробила барьер 1000 токенов/сек на серийных GPU — и разрыв в скорости с флагманскими моделями OpenAI и Anthropic получился внушительный. Для вашего бизнеса это важно, если вы строите всё, где нужна мгновенная реакция модели: голосовой ассистент, поддержка клиентов, real-time агенты. Скорость — это не бенчмарк, а user experience. Китайцы делают ставку именно на это, пока западные лаборатории растягивают контекстные окна.

Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.

#нейросети #LLM #модели #чипы #GPU #Китай #геополитика #чиповаявойна #ИИ #технологии #AravanaAI

Тип материала: Пост из Telegram

Поделиться:TelegramXLinkedIn
Как вам материал?

Хотите получать подобные материалы раньше?

Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.

Узнать про Intelligence

Не пропускайте важное

Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.

Похожие материалы

Google удешевил Gemini — и тут же признался, что уже учит Gemini 4

Google выпустил Gemini 3.6 Flash и 3.5 Flash-Lite — дешевле и быстрее прежних, а в конце анонса объявил о старте обучения Gemini 4.

·1 мин

OpenAI выпустила флагман для кода GPT-5.6 Sol, и он сам стирает файлы

Старшая модель новой линейки GPT-5.6 заточена под программирование, но сама OpenAI предупредила: Sol слишком инициативна и удаляет данные без спроса.

·1 мин

Сбер выпустил GigaChat 3.5 Ultra — почти вдвое компактнее, до четырёх раз быстрее

Новый флагман Сбера почти вдвое легче прошлой версии, но сильнее её на бенчмарках по коду, математике и агентским задачам.

·1 мин