Китайская модель впервые пробила топ-5 кодеров — четыре места у Claude, одно у Alibaba

Qwen3.7-Max от Alibaba набрала 1 541 балл и заняла 4-е место в Code Arena, обойдя все модели OpenAI и Google. Остальные четыре места в топ-5 — у разных версий Claude.

Aravana··1 мин

🔴 Китайская модель впервые пробила топ-5 кодеров — четыре места у Claude, одно у Alibaba

В глобальном рейтинге Code Arena теперь только пять моделей, способных самостоятельно собрать рабочее веб-приложение с нуля. Четыре места заняли разные версии Claude. Пятая модель — из Китая.

Как пишет SCMP, Qwen3.7-Max от Alibaba набрала 1 541 балл и встала на 4-ю строчку, обойдя все актуальные модели OpenAI и Google. Code Arena — не классический бенчмарк с готовыми задачами, а песочница, где модель должна построить полноценное интерактивное приложение от первой строчки кода. Раньше в верхушке рейтинга жили только американские лаборатории. Сейчас впервые рядом с ними стоит китайский разработчик, и сделал это не дорогим закрытым продуктом, а моделью, которую Alibaba раздаёт через свой Cloud по корпоративным контрактам.

Для российского предпринимателя это конкретный сигнал. Стоимость доступа к топ-уровню кодинг-моделей перестала быть монополией одного–двух американских провайдеров. Если ваша команда упирается в лимиты или цены Anthropic, у Qwen3.7-Max теперь сопоставимое качество в типовых задачах сборки приложений — и заметно ниже цена за запрос. Тестируйте на своих сценариях, а не на чужих демках.

Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.

#нейросети #LLM #модели #Claude #Anthropic #Google #OpenAI #Китай #геополитика #ИИ #технологии #AravanaAI

Тип материала: Пост из Telegram

Поделиться:TelegramXLinkedIn
Как вам материал?

Хотите получать подобные материалы раньше?

Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.

Узнать про Intelligence

Не пропускайте важное

Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.

Похожие материалы

Голосовой Grok обошёл специализированные модели расшифровки речи на их же поле

xAI выкатила Grok Voice Think Fast 2.0: модель рассуждает параллельно с речью, обогнала OpenAI GPT-Realtime-2.1 и Google Gemini 3.1 Flash и оказалась точнее специализированных моделей расшифровки речи. Ценник — $0,08 за минуту аудио.

·1 мин

Приватные чаты с Claude всплыли в поиске Google

Диалоги пользователей Claude, которыми делились по «приватной» ссылке, попали в индекс Google и Bing — среди утёкшего медзаписи, внутренние документы и персональные данные.

·1 мин

DeepSeek заморозила раунд при оценке ~$67 млрд из-за пары вирусных постов

DeepSeek сообщила инвесторам о паузе во втором раунде на ~$1,4 млрд при оценке около $67 млрд — спустя недели после первого раунда на $7 млрд и на фоне вирусных постов основателя.

·1 мин