🔴 Alibaba показала Qwen3.8-Max — но главный тест начнётся только после релиза

Alibaba заявляет о 2,4 трлн параметров и 16-дневной автономной работе, но ключевая проверка начнётся после публичного релиза.

Aravana··1 мин

🔴 Alibaba показала Qwen3.8-Max — но главный тест начнётся только после релиза

Alibaba представила Qwen3.8-Max в гонке с Anthropic, но пользоваться моделью пока нельзя: публичный релиз намечен на следующую неделю. Компания заявляет 2,4 трлн параметров и контекст до миллиона токенов — этого достаточно для обработки тысяч страниц.

Масштаб здесь не единственный аргумент. По опубликованным Alibaba сравнениям, Qwen3.8-Max в отдельных тестах работает на уровне модели Anthropic или превосходит её, однако занимает второе место в Vision Arena и пятое в Text Arena. Пока это не безусловное лидерство, а сильные результаты в отдельных дисциплинах.

Самая смелая заявка — внутренний эксперимент Alibaba. Модель 16 дней создавала и улучшала AI-инструмент для программистов: писала и тестировала код, исправляла ошибки и повторяла цикл при минимальном участии человека. Компания также заявляет о работе с юридическими документами, финансовыми исследованиями и архитектурным 3D-моделированием.

Поэтому решающим станет не размер модели и не место в рейтинге. После запуска независимым пользователям предстоит проверить, воспроизводит ли Qwen3.8-Max многодневную автономную работу за пределами внутреннего теста Alibaba.

Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.

#ИИ #Alibaba #Qwen #Anthropic #AIмодели #AravanaAI

Тип материала: Пост из Telegram

Поделиться:TelegramXLinkedIn
Как вам материал?
Теги:MODELSAI

Хотите получать подобные материалы раньше?

Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.

Узнать про Intelligence

Не пропускайте важное

Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.