Grok 4.6

Grok 4.6 — модель разработчика xAI, семейство Grok. Ниже — места в рейтингах, цены, режимы работы и ближайшие альтернативы.

История рейтинга

Загружаем историю замеров…

Главное

  • Место в общем рейтинге87-еиз 402Индекс интеллекта 44,4 · 8-е из 95
    режим high · замер 13 сентября 2026
  • Цена за 1 млн токенов$2 / $6вход / выходу отдельных провайдеров до $4 / $12
  • Контекст500 000токеновответ до 450 000 токенов
  • ПринимаетТекст, изображения, файлыотвечает: текст
  • Выход модели10 августа 2026
  • БесплатноНеттолько платные тарифы

Для каких задач

Места по открытым замерам оценок людей, лучший режим модели; замеры 11 сентября 2026 — 15 сентября 2026.

Бенчмарки

  • Индекс интеллекта44,48-е из 95лучший результат 53,4 у Claude Fable 5.1
  • Индекс программирования76,85-е из 125лучший результат 81,6 у Claude Fable 5.1
  • Индекс агентных задач53,45-е из 95лучший результат 58,0 у Claude Fable 5.1

Дизайн и вёрстка

  • Android-приложения 2-еиз 35· побед 59 %
  • Agents: htmlslides 3-еиз 23· побед 60 %
  • Мобильные приложения 5-еиз 40· побед 57 %
  • ASCII-графика 7-еиз 61· побед 59 %
  • Полноценные приложения 7-еиз 41· побед 55 %
  • Веб-приложения 8-еиз 39· побед 57 %

Индексы — сводные оценки независимой лаборатории тестирования; проверка на площадках — прогоны агрегатора у провайдеров, показан диапазон результатов; дизайн — парные сравнения вёрстки и кода по категориям.

Места в рейтингах

РейтингМестоОценкаРежимВыборкаДата замера
Общий зачёт
87-еиз 402
1 430 1 424–1 436high15 52113 сентября 2026
Программирование
69-еиз 397
1 463 1 454–1 473high4 01213 сентября 2026
Математика
121-еиз 384
1 415 1 393–1 437high71913 сентября 2026
Русский язык
76-еиз 366
1 427 1 413–1 441high1 80213 сентября 2026
Веб-разработка
13-еиз 127
1 618 1 607–1 628high4 28211 сентября 2026
Работа с изображениями
40-еиз 152
1 267 1 256–1 278high3 63213 сентября 2026
Агентные задачи
21-еиз 46
2,01 % 0,96 %–3,05 %xhigh2 390 55215 сентября 2026
Работа с документами
25-еиз 44
1 452 1 440–1 464high2 25813 сентября 2026

Оценка — рейтинг по парным сравнениям людей, рядом интервал разброса; для агентных задач показана доля успешных выполнений. Выборка — число голосов или прогонов в снимке.

Популярность: 0,35 % наблюдённых токенов через API-агрегаторы за 30 дней (по 17 сентября 2026).

Режимы работы

РежимЧто этоМеста в рейтингахЦена за 1 млн токенов
режим highглубокое рассуждение · по умолчаниюОбщий зачёт 87-е из 402 · Программирование 69-е из 397 · Математика 121-е из 384 и ещё 4как у модели
режим xhighочень глубокое рассуждениеАгентные задачи 21-е из 46как у модели
режим low, режим mediumуровни рассуждения без отдельных замеровРейтинг не измеренкак у модели

Режимы — уровни рассуждения одной модели и маршруты доступа. Токены рассуждения оплачиваются как ответ; цена одна, кроме пакетной обработки и бесплатного маршрута.

Сколько это стоит на практике

  • $3,60Чат-помощник1 000 сообщений: 300 токенов запроса и 500 токенов ответа каждоевход 300 000 · выход 500 000 токенов
  • $11,20Разбор документов100 документов по 50 000 токенов входа, ответ 2 000 токеноввход 5 000 000 · выход 200 000 токенов
  • $12,80Программирование200 задач по 20 000 токенов входа и 4 000 токенов ответавход 4 000 000 · выход 800 000 токенов

Сумма = вход × цена входа + выход × цена выхода, цены за 1 млн токенов, проверены 10 сентября 2026. Токены рассуждения оплачиваются как ответ.

Альтернативы

  • Лидер общего рейтингаClaude Fable 5.11-е из 402 в общем зачётецена $10 / $50выше на 86 мест
  • Дешевле у xAIGrok 4.20 Multi-Agent46-е из 402 в общем зачётецена $1,25 / $2,50дешевле в 2,1 раза, на 41 место выше
  • Дешевле при том же уровнеGemma 4 26B A4B 80-е из 402 в общем зачётецена $0,09 / $0,30дешевле в 21 раза, на 7 мест выше
  • Китайская альтернативаQwen3.8 Max (0902)14-е из 402 в общем зачётецена $2 / $6разработчик Alibaba Qwen, Китай

Подбор по последнему снимку общего зачёта и ценам за 1 млн токенов (вход + выход).

Данные и источники

Обновлено 18 сентября 2026. Каталог, цены и режимы проверяются ежедневно по нескольким API-агрегаторам и провайдерам. Места — по открытым замерам оценок людей, интервалы приведены как в замере. Популярность — доля наблюдённых токенов через API-агрегаторы за 30 дней.

Как мы считаем: методика