Новая Grok 4.6 обошла GPT-5.6 Sol Max и Claude Fable 5 Max в ряде тестов

12 августа 2026 года стала доступна новая языковая модель Grok 4.6 от xAI. Разработчики позиционируют её как заметное улучшение Grok 4.5 при сохранении прежней стоимости использования, а первые независимые тесты уже сравнивают новинку с сильнейшими моделями OpenAI и Anthropic.

Одним из заметных результатов стал бенчмарк GDPval-AA v2, оценивающий выполнение задач, приближенных к реальной профессиональной работе. В нём Grok 4.6 смогла показать результат выше Claude Fable 5 Max и GPT-5.6 Sol Max. При этом делать вывод о безоговорочном лидерстве модели пока рано – результаты разных тестов могут заметно отличаться в зависимости от типа задач.

Среди заявленных особенностей Grok 4.6:

  • улучшенные способности к рассуждению и работе со сложными запросами;
  • более высокие показатели в профессиональных и агентных задачах;
  • улучшения относительно Grok 4.5 без повышения базовой стоимости;
  • сохранение ориентации на высокую скорость работы и эффективность;
  • конкуренция с флагманскими моделями OpenAI и Anthropic в ряде независимых тестов.

Предыдущее крупное обновление линейки – Grok 4.5 – вышло в июле. Тогда модель уже считалась одним из наиболее выгодных вариантов по соотношению производительности и стоимости, хотя по общему индексу Artificial Analysis уступала GPT-5.6 Sol. Новая версия должна сократить этот разрыв и в некоторых сценариях уже выходит вперёд.

При этом на момент написания материала xAI ещё не опубликовала подробную модельную карточку Grok 4.6 и полноценный технический отчёт, поэтому часть характеристик и заявлений о производительности пока основывается на первых тестах и сообщениях пользователей.

Ответьте на 15 вопросов о The International 2026 и узнайте, насколько хорошо вы разбираетесь в главном турнире года по Dota 2
Ответьте на 15 вопросов о The International 2026 и узнайте, насколько хорошо вы разбираетесь в главном турнире года по Dota 2
Комментарии
Нет комментариев. Будьте первым!