Xai

Grok 4.5

Запуски бенчмарка версии 4.5 на общих визуальных подсказках Mantis.

Проверенные данные о модели

Идентичность, ограничения и цены

Источник провайдера · проверено 01.09.2026 ↗
Статус
Текущая
ID модели API
grok-4.5
Контекст
500K
Максимальный вывод
Не подтверждено публично
Лицензия
Не подтверждено публично
Способ доступа
Не подтверждено публично
Модальности
Не подтверждено публично
Аппаратное обеспечение
Не подтверждено публично
Цена API / 1 млн токенов
$2 за входные данные · $0,3 за кэшированные входные данные · $6 за вывод

Подсказки на 200 000 токенов и более используют повышенную ставку провайдера за длительный контекст.

Визуальные тесты с одинаковым промптом

Просмотреть фактические прогонки

Откройте сгенерированную сцену для тестирования или сравните этот промпт с другой моделью.

7 запусков

Симулятор полета на метле в Хогвартсе

Тестирование сцены полета на метле: глубина, визуальные подсказки движения, масштаб замка и фантастическое настроение.

Официальный профиль бенчмарка

Опубликованные результаты за пределами наших визуальных тестов

xAI описывает Grok 4.5 как модель для кодирования, агентных задач и работы с знаниями. xAI публикует разные строки бенчмарка, чем OpenAI/Anthropic, поэтому показаны только прямые сравнения источников.

Источник SpaceXAIИюль 2026Исходный отчет →
Кодирование

DeepSWE 1.0

62.0%
Кодирование

DeepSWE 1.1

53.0%
Долгосрочное программирование

SWE Марафон

29.0%
Полная официальная таблица бенчмарков6 строк с исходными настройками и графиками коллег
БенчмаркОбластьБаллНастройка / сравнение
DeepSWE 1.0Кодирование62.0%xAI сообщил о бенчмарке по программной инженерии.
DeepSWE 1.1Кодирование53.0%xAI сообщил о бенчмарке по программной инженерии.
SWE МарафонДолгосрочное программирование29.0%xAI сообщил о бенчмарке по долгосрочному кодированию.
Выходные токены SWE Bench ProЭффективность15,954 в среднем.Среднее количество выходных токенов по задачам SWE Bench Pro.
Эффективность выходных токеновЭффективностьВ 4,2 раза меньше, чем у Opus 4.8Сравнение xAI по задачам SWE Bench Pro.xAI сравнивает Grok 4.5 с Opus 4.8 на максимуме по задачам SWE Bench Pro.
Скорость обслуживанияЗадержка80 TPSСообщенная скорость генерации.