Grok 4.6 вышла: новая модель xAI сравнялась с GPT-5.6 Sol и оказалась дешевле конкурентов

от автора

xAI выпустила Grok 4.6 — модель для программирования, многошаговых ИИ-агентов и работы с большими объёмами информации. По совокупной оценке Artificial Analysis новинка сравнялась с GPT-5.6 Sol, а в отдельных тестах обошла его.

При этом базовые цены остались на уровне Grok 4.5: от $2 за миллион входящих и $6 за миллион исходящих токенов. Разбираемся, где Grok 4.6 действительно сильна и сможет ли она потеснить флагманы OpenAI и Anthropic.

Что изменилось в Grok 4.6

Grok 4.6 вышла 12 августа 2026 года — меньше чем через месяц после Grok 4.5. Это не новая архитектура с нуля, а усиленная версия предыдущей модели.

Главный акцент xAI сделала на длинных задачах. Grok 4.6 должна лучше удерживать цель при работе в несколько десятков шагов: исследовать тему, анализировать документы, писать и проверять код, собирать приложение, а затем исправлять результат по замечаниям пользователя.

Для дополнительного обучения xAI использовала инженерные данные, задачи по STEM, программированию, веб-разработке, проектированию и оптимизации вычислительных ядер. Часть тренировочных траекторий сгенерировала Grok 4.5, после чего результаты отфильтровали с помощью других моделей.

По наблюдениям разработчиков, Grok 4.6 чаще проверяет собственную работу перед переходом к следующему шагу. Особенно это заметно при создании интерфейсов и интерактивных приложений: модель способна сразу собрать рабочую первую версию, а не ограничиться фрагментами кода.

Характеристики Grok 4.6

Контекстное окно модели составляет 500 000 токенов. Этого достаточно для анализа крупной кодовой базы, десятков документов или продолжительной истории запросов.

Grok 4.6 принимает текст и изображения, но отвечает только текстом. Формального ограничения на длину текстового ответа xAI не указывает. Дата отсечения знаний — 1 февраля 2026 года.

В API доступны четыре уровня рассуждения:

  • low;

  • medium;

  • high — используется по умолчанию;

  • xhigh — для наиболее сложных задач.

Модель поддерживает function calling, структурированные ответы, исполнение кода, поиск в интернете и поиск по X. Её можно использовать через Responses API и Chat Completions API. Документация Grok 4.6.

Grok 4.6 против GPT-5.6 Sol и Claude Fable 5

По таблице xAI, Grok 4.6 набрала 61 балл в Artificial Analysis Intelligence Index. Столько же получила GPT-5.6 Sol Max. Claude Fable 5 Max осталась немного впереди с 62 баллами.

Отрыв от Grok 4.5 заметнее: предыдущая версия набрала 56 баллов.

Тест

Grok 4.6 High

GPT-5.6 Sol Max

Claude Fable 5 Max

AA Intelligence Index

61

61

62

GDPVal-AA v2

1753

1728

1741

CursorBench 3.2

69,9%

67,2%

70,5%

DeepSWE 1.1

65,9%

73%

70%

FrontierCode 1.1 Extended

61,3%

60,6%

63,6%

AA-Briefcase

1577

1502

1574

Картина получилась неоднозначной. В DeepSWE и Terminal-Bench модель уступает конкурентам, поэтому называть её новым безусловным лидером в программировании пока рано.

Зато Grok 4.6 хорошо показывает себя в агентных задачах и работе с информацией. В GDPVal-AA v2 она набрала 1753 пункта — больше GPT-5.6 Sol и Claude Fable 5. В AA-Briefcase модель также немного опередила обе системы.

Именно здесь находится главное улучшение. Grok 4.6 стала сильнее не столько в ответах на отдельные вопросы, сколько в продолжительной работе, где нужно пользоваться инструментами, возвращаться к предыдущим результатам и не терять исходную задачу.

Artificial Analysis также отметила экономность модели. В их тестах одна задача обходилась в среднем в $0,84. Для сравнения, Grok 4.6 выполняла задания примерно за 53 шага и использовала около 0,5 миллиарда входящих токенов. Claude Opus 5 Max требовалось около 103 шагов и 2 миллиардов токенов. Независимый анализ Artificial Analysis.

Сколько стоит Grok 4.6

При запросах до 200 000 токенов действуют следующие цены:

  • входящие токены — $2 за миллион;

  • закэшированный ввод — $0,50 за миллион;

  • исходящие токены — $6 за миллион.

Если промпт превышает 200 000 токенов, стоимость удваивается: $4 за миллион входящих, $1 за закэшированный ввод и $12 за миллион исходящих токенов.

xAI также предлагает ускоренную версию с удвоенной ценой.

Базовый тариф не изменился по сравнению с Grok 4.5, хотя показатель Artificial Analysis вырос сразу на пять пунктов. По расчётам независимой площадки, Grok 4.6 более чем на 60% дешевле Claude Opus 5 и GPT-5.6 Sol по заявленной стоимости токенов.

Но при работе с крупными документами нужно следить за границей в 200 000 токенов. Контекст в 500 000 токенов доступен, однако его полное использование заметно увеличит итоговый счёт.

Что можно делать с Grok 4.6

Модель ориентирована прежде всего на разработчиков и пользователей, которым нужны многошаговые сценарии:

  • анализировать кодовую базу и проводить ревью;

  • искать и исправлять ошибки;

  • собирать прототипы приложений;

  • работать с PDF и изображениями;

  • готовить исследования с поиском по интернету;

  • извлекать данные из больших документов;

  • возвращать результат по заданной JSON-схеме;

  • управлять внешними инструментами через function calling.

Grok 4.6 не заменяет отдельные модели Grok Imagine для генерации изображений и видео. Она может проанализировать картинку, интерфейс или скриншот, но на выходе создаёт только текст.

Как попробовать Grok 4.6

Для прямого доступа к API нужен аккаунт xAI, API-ключ и пополненный баланс. Российские банковские карты сервис напрямую не принимает, поэтому пользователям из России потребуется зарубежный способ оплаты или посредник.

Grok 4.6 уже доступна на SpeShu.AI. Модель можно запустить без VPN, отдельного аккаунта xAI и зарубежной карты. Оплата идёт в рублях по СБП за фактически использованные токены, без обязательной подписки.

Стоит ли переходить на Grok 4.6

Если Grok 4.5 уже используется для кода, исследований или ИИ-агентов, переход выглядит оправданным: базовая цена не изменилась, а результаты в многошаговых задачах выросли.

Сравнение с конкурентами сложнее. GPT-5.6 Sol остаётся сильнее в DeepSWE, а Claude Fable 5 чаще занимает первое место в тестах программирования. Grok 4.6 берёт другим сочетанием: 500 000 токенов контекста, сильные агентные результаты и стоимость от $2/$6 за миллион токенов.

Поэтому Grok 4.6 — пока не абсолютный лидер во всех категориях. Но это уже модель верхнего уровня, которая способна конкурировать с актуальными флагманами OpenAI и Anthropic, а в некоторых рабочих сценариях обходится заметно дешевле.

ссылка на оригинал статьи https://habr.com/ru/articles/1073970/