Xai
Grok 4.5
Запуски бенчмарка версии 4.5 на общих визуальных подсказках Mantis.
Проверенные данные о модели
Идентичность, ограничения и цены
- Статус
- Текущая
- ID модели API
grok-4.5- Контекст
- 500K
- Максимальный вывод
- Не подтверждено публично
- Лицензия
- Не подтверждено публично
- Способ доступа
- Не подтверждено публично
- Модальности
- Не подтверждено публично
- Аппаратное обеспечение
- Не подтверждено публично
- Цена API / 1 млн токенов
- $2 за входные данные · $0,3 за кэшированные входные данные · $6 за вывод
Подсказки на 200 000 токенов и более используют повышенную ставку провайдера за длительный контекст.
Визуальные тесты с одинаковым промптом
Просмотреть фактические прогонки
Откройте сгенерированную сцену для тестирования или сравните этот промпт с другой моделью.

Симулятор полета на метле в Хогвартсе
Тестирование сцены полета на метле: глубина, визуальные подсказки движения, масштаб замка и фантастическое настроение.

Jabberwock
Тестирование встречи в стиле тёмного фэнтези: дизайн существ, настроение леса и постановка повествования.

Мир с низкой полигонажностью
Стилизованная островная сцена для тестирования композиции, цвета и низкополигонального миростроения.

Офисная жизнь
Офисная виньетка для тестирования логики повседневной сцены, объектов и достоверных офисных деталей.

Петри
Микроскопическая экосистема для тестирования органических форм, научной ясности и клеточных деталей.

Симулятор вселенной
Космическая система для тестирования орбитальной структуры, светящихся тел, масштаба и читаемости симуляции.

Вайс Сити
Неоновый прибрежный город для тестирования транспортных средств, архитектуры, атмосферы и плотной городской планировки.
Официальный профиль бенчмарка
Опубликованные результаты за пределами наших визуальных тестов
xAI описывает Grok 4.5 как модель для кодирования, агентных задач и работы с знаниями. xAI публикует разные строки бенчмарка, чем OpenAI/Anthropic, поэтому показаны только прямые сравнения источников.
DeepSWE 1.0
62.0%DeepSWE 1.1
53.0%SWE Марафон
29.0%Полная официальная таблица бенчмарков6 строк с исходными настройками и графиками коллег
| Бенчмарк | Область | Балл | Настройка / сравнение |
|---|---|---|---|
| DeepSWE 1.0 | Кодирование | 62.0% | xAI сообщил о бенчмарке по программной инженерии. |
| DeepSWE 1.1 | Кодирование | 53.0% | xAI сообщил о бенчмарке по программной инженерии. |
| SWE Марафон | Долгосрочное программирование | 29.0% | xAI сообщил о бенчмарке по долгосрочному кодированию. |
| Выходные токены SWE Bench Pro | Эффективность | 15,954 в среднем. | Среднее количество выходных токенов по задачам SWE Bench Pro. |
| Эффективность выходных токенов | Эффективность | В 4,2 раза меньше, чем у Opus 4.8 | Сравнение xAI по задачам SWE Bench Pro.xAI сравнивает Grok 4.5 с Opus 4.8 на максимуме по задачам SWE Bench Pro. |
| Скорость обслуживания | Задержка | 80 TPS | Сообщенная скорость генерации. |