🔴 Alibaba показала Qwen3.8-Max — но главный тест начнётся только после релиза

Alibaba заявляет о 2,4 трлн параметров и 16-дневной автономной работе, но ключевая проверка начнётся после публичного релиза.

Aravana··1 мин

🔴 Alibaba показала Qwen3.8-Max — но главный тест начнётся только после релиза

Alibaba представила Qwen3.8-Max в гонке с Anthropic, но модель уже доступна через API QwenCloud, а на следующую неделю намечена публикация открытых весов на Hugging Face и ModelScope. Компания заявляет 2,4 трлн параметров и контекст до миллиона токенов — этого достаточно для обработки документов объёмом свыше 200 страниц за один запрос.

Масштаб здесь не единственный аргумент. По результатам сравнений, опубликованных Alibaba, Qwen3.8-Max в отдельных тестах работает на уровне модели Anthropic или превосходит её, однако занимает второе место в Vision Arena и пятое в Text Arena. Пока это не безусловное лидерство, а сильные результаты в отдельных дисциплинах.

Самая смелая заявка — внутренний эксперимент Alibaba. Модель 16 дней создавала и улучшала AI-инструмент для программистов: писала и тестировала код, исправляла ошибки и повторяла цикл без участия человека. Компания также заявляет о работе с юридическими документами, финансовыми исследованиями и архитектурным 3D-моделированием.

Поэтому решающим фактором станет не размер модели и не место в рейтинге. После запуска независимым пользователям предстоит проверить, способна ли Qwen3.8-Max воспроизвести многодневную автономную работу вне внутренних тестов Alibaba.

Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.

#ИИ #Alibaba #Qwen #Anthropic #AIмодели #AravanaAI

Тип материала: Пост из Telegram

Поделиться:TelegramXLinkedIn
Как вам материал?

Хотите получать подобные материалы раньше?

Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.

Узнать про Intelligence

Не пропускайте важное

Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.

Похожие материалы

Исследование Стэнфорда: дружба с ИИ связана с одиночеством, но причина неясна

Исследование пользователей Character.AI выявило связь между поиском компании у чат-ботов, небольшим кругом общения и более низким психологическим благополучием, но не установило причинность.

·1 мин

Anthropic открыла ENISA доступ к Mythos 5 — но не к новейшей версии

ENISA после нескольких месяцев переговоров начала тестировать Mythos 5, но не получила актуальную версию модели.

·1 мин

🔴 Harvey привлекла $550 млн: юридический AI уже покупают 3 000 организаций

Harvey привлекла $550 млн после роста до более чем 3 000 клиентов, но масштабирование юридического AI упирается в конфликт между производительностью и почасовой оплатой.

·1 мин