Alibaba обновила Qwen3.8-Max: в бенчмарках модель обошла Claude Opus 5 и ChatGPT 5.6 Sol

Alibaba ночью обновила флагманскую модель Qwen3.8-Max до ревизии Qwen3.8-Max-0902. Команда Qwen провела дополнительное post-training под программирование (Coding) и совместную работу агентов (Cowork), и заявляет, что в части бенчмарков обновление обходит Claude Opus 5 и ChatGPT 5.6 Sol.

Qwen3.8-Max, иллюстрация CyberMeta
Qwen3.8-Max, иллюстрация CyberMeta

На фронтенд-рейтинге CodeArena модель поднялась на 22 пункта до 1691 и заняла первое место. По описанию Alibaba, Qwen3.8-Max сильнее в многошаговом рассуждении, вызове инструментов и генерации приложений целиком – то есть в сценариях, где обычно работают AI-агенты для разработки.

В свежем списке моделей по соотношению цены и качества Qwen3.8-Max-0902 указана с усреднённой стоимостью около $5 за миллион токенов. Для сравнения: ближайшие конкуренты в том же рейтинге стоят примерно $20 и $12 за миллион. По API у ревизии Qwen3.8-Max-0902 тариф $2 на ввод и $6 на вывод за миллион токенов.

Сравнение с Claude Fable 5.1, которую Anthropic представила накануне, в материалах Alibaba пока не фигурирует – то есть прямого бенчмарка против самой свежей линейки Anthropic ещё нет. Модель уже доступна через API на платформе Qwen, а также в Qoder, Qwen App и корпоративных продуктах Alibaba.

Комментарии
Нет комментариев. Будьте первым!