Xai

Уровень S · По умолчанию «Ship-to-prod».

Grok 4.6

Выберите Grok 4.6 для быстрых агентских циклов. Для сложного качества кодирования рассматривайте его как ближе к уровню A.

Проверенные данные о модели

Идентичность, ограничения и цены

Источник провайдера · проверено 01.09.2026 ↗
Статус
Текущая
ID модели API
grok-4.6
Контекст
500K
Максимальный вывод
Не подтверждено публично
Лицензия
Не подтверждено публично
Способ доступа
Не подтверждено публично
Модальности
Не подтверждено публично
Аппаратное обеспечение
Не подтверждено публично
Цена API / 1 млн токенов
$2 за входные данные · $0,3 за кэшированные входные данные · $6 за вывод

Подсказки на 200 000 токенов и более используют повышенную ставку провайдера за длительный контекст.

Визуальные тесты с одинаковым промптом

Просмотреть фактические прогонки

Откройте сгенерированную сцену для тестирования или сравните этот промпт с другой моделью.

16 запусков

Городское путешествие по прокрутке

Кинематографическое путешествие по прокрутке, тестирующее непрерывность сцен, сгенерированных ИИ, движение камеры при прокрутке и художественно оформленные посадочные аппараты.

Симулятор полета на метле в Хогвартсе

Тестирование сцены полета на метле: глубина, визуальные подсказки движения, масштаб замка и фантастическое настроение.

Симулятор механических часов

Интерактивное тестирование часов: механическая читаемость, точное относительное движение и управление в 3D в реальном времени.

Симулятор Требушета Штормграда

Тестирование осадного моделирования Counterweight с проверкой связанных механизмов, предсказанием траектории, камерами для снарядов и интерактивной настройкой.

Редакционный вердикт

Где подходит эта модель

Вернуться ко всем тестам →

Grok 4.6 достаточно быстр, чтобы менять работу мульти-шаговых агентов и стал практическим вариантом Hermes. Он всё ещё может отклоняться во время задачи, а качество его кода не всегда соответствует наилучшим планировщикам и разработчикам.

Лучшее для

  • Быстрые циклы агента
  • Hermes и параллельная работа агентов
  • Амбициозные интерактивные сборки
  • Задачи, где задержка изменяет рабочий процесс

Внимание

  • Всё ещё может отклоняться на полпути через задачу
  • Качество кода ощущается как уровень A, даже когда полезность агента на уровне S
  • Проверяйте сгенерированную работу перед её выпуском

Почему она занимает это место

  1. Редакционное разделение: S для полезности агента и A для качества кода, при этом скорость определяет общий уровень.
  2. Команда использует Grok в Hermes, потому что меньшая задержка улучшает работу с несколькими шагами.
  3. Шестнадцать видимых запусков Mantis поддерживают инспекцию, но это размещение всё ещё является редакционной рекомендацией, а не универсальной оценкой.

Доказательства

2026-08-27

Рейтинг редакционной модели Mantis

Основной вывод: Grok 4.6 в настоящее время размещён в категории S.

Редакционная таблица на август 2026 года помещает Grok 4.6 на 3-е место.

Открытый исходный код →
2026-08-12

Представляем Grok 4.6

Основной вывод: Grok 4.6 размещён в категории S для текущего набора визуальных сборок и данных по агентскому кодированию.

SpaceXAI сообщает о таблице запусков; Mantis сохраняет видимыми запуски и настройки источников, а не сводит их в одну оценку.

Открытый исходный код →

Официальный профиль бенчмарка

Опубликованные результаты агентского кодирования и работы с знаниями Grok 4.6.

xAI сообщает о Grok 4.6 на основе смеси композитных, знаний и агентского кодирования оценок. Приведённые ниже строки сохраняют точные обозначения бенчмарков xAI и сравнивают только указанные конфигурации в одной таблице запусков.

Источник SpaceXAIАвгуст 2026отчет о запуске xAI →
Композитная способность

Индекс интеллекта AA

61
Работа с знаниями

GDPVal-AA v2

1753
Агентное кодирование

CursorBench v3.2

69.9%
Полная официальная таблица бенчмарков10 строк с исходными настройками и графиками сверстников
БенчмаркОбластьБаллНастройка / сравнение
Индекс интеллекта AAКомпозитная способность61результат таблицы запуска xAI; индекс агрегирует девять эталонов.
GDPVal-AA v2Работа с знаниями1753рейтинг таблицы запуска xAI; выше — лучше.
CursorBench v3.2Агентное кодирование69.9%результат таблицы запуска xAI для указанной конфигурации CursorBench.
Fable 5 Max70.5%
Grok 4.669.9%
GPT-5.6 Sol67.2%
Grok 4.566.7%
DeepSWE v1.1Разработка программного обеспечения65.9%результат таблицы запуска xAI для настройки DeepSWE v1.1.
GPT-5.6 Sol73.0%
Fable 5 Max70.0%
Grok 4.665.9%
Grok 4.554.0%
FrontierCode v1.1 (Расширенная)Долгосрочное программирование61.3%результат таблицы запуска xAI для расширенного варианта.
Fable 5 Max63.6%
Grok 4.661.3%
GPT-5.6 Sol60.6%
Grok 4.556.6%
Terminal-Bench v3.0Агент командной строки26.0%Результат таблицы запуска xAI. Этот новый эталонный тест несовместим с результатами Terminal-Bench 2.x на других страницах сайта.
APEX-АгентыНадежность агента57.5%Результат таблицы запуска xAI для оценки указанных APEX-агентов.
Fable 5 Max59.2%
Grok 4.657.5%
GPT-5.6 Sol56.7%
Grok 4.547.1%
APEX-SWEРазработка программного обеспечения56.4%Результат таблицы запуска xAI для оценки указанных APEX-SWE.
Fable 5 Max58.8%
Grok 4.656.4%
Grok 4.553.6%
AA-ПортфельРабота с знаниями1577рейтинг таблицы запуска xAI; выше — лучше.
Лаборатория Harvey (значения)Юридическая работа15.8%Результат таблицы запуска xAI для оценки Harvey LAB (значения).
Grok 4.615.8%
Grok 4.512.9%
Fable 5 Max11.3%
GPT-5.6 Sol2.5%