Независимые измерения ведут. Результаты поставщиков остаются в отдельных, связанныc источниками линиях.
Независимое сравнение
Независимые оценки по 9 моделям.
Индекс искусственного анализа v4.1 объединяет девять оценок по программированию, агентной работе, науке, знаниям, физике и рассуждениям в длинном контексте. Чем выше, тем лучше.
- Grok 4.6Высокий61Источник AA ↗
- Claude Fable 5Max, резервная версия Opus 4.860Источник AA ↗
- Claude Opus 5Адаптивное рассуждение, очень высокий60Источник AA ↗
- GPT-5.6 SolМакс59Источник AA ↗
- Kimi K3Рассуждение57Источник AA ↗
- GPT-5.6 TerraМакс55Источник AA ↗
- GPT-5.5xвысокий55Источник AA ↗
- Grok 4.5Высокий54Источник AA ↗
- GPT-5.6 LunaВысокий46Источник AA ↗
Конфигурация имеет значение. Fable 5 включает опубликованную резервную версию Opus 4.8. Оценки GPT и Claude используют уровень усилий, указанный рядом с каждой моделью.
Исследователь стоимости
Рассчитайте стоимость вашей фактической рабочей нагрузки.
Установите входные и выходные токены для одной задачи. Исследователь применяет текущие цены из списка API и перерассчитывает каждую модель в том же сценарии.
| Модель | Индекс AA | Вход / 1М | Выход / 1М | Скорость | Ваша задача |
|---|---|---|---|---|---|
| Claude Fable 5Anthropic · Max, Opus 4.8 резервный вариант | 60Индекс | $10.00 | $50.00 | 69.7tokens/sec | Данные AA ↗Цена ↗ |
| Claude Opus 5Anthropic · Адаптивное рассуждение, очень высокий | 60Индекс | $5.00 | $25.00 | 53.1tokens/sec | Данные AA ↗Цена ↗ |
| GPT-5.6 SolOpenAI · Max | 59Индекс | $4.00 | $20.00 | 77.1tokens/sec | Данные AA ↗Цена ↗ |
| Kimi K3Moonshot AI · Рассуждение | 57Индекс | $3.00 | $15.00 | 32.0tokens/sec | Данные AA ↗Цена ↗ |
| GPT-5.6 TerraOpenAI · Max | 55Индекс | $2.50 | $15.00 | 134.5tokens/sec | Данные AA ↗Цена ↗ |
| GPT-5.5OpenAI · Очень высокий | 55Индекс | $5.00 | $30.00 | 72.5tokens/sec | Данные AA ↗Цена ↗ |
| Grok 4.5Xai · Высокий | 54Индекс | $2.00 | $6.00 | 67.1tokens/sec | Данные AA ↗Цена ↗ |
| Grok 4.6Xai · Высокий | 61Индекс | $2.00 | $6.00 | 65.1tokens/sec | Данные AA ↗Цена ↗ |
| GPT-5.6 LunaOpenAI · Высокий | 46Индекс | $1.00 | $6.00 | 178.0tokens/sec | Данные AA ↗Цена ↗ |
Включено: стандартный ввод и сгенерированный вывод по ценам API, проверено 01.09.2026.
Не включено: запись в кэш, вызовы инструментов, хранение, скидки за пакет, наценки провайдера или дополнительные токены, которые модель может использовать для завершения той же задачи.
Смешанный ориентир: Artificial Analysis также публикует цену за кэш-опыта/ввод/вывод 7:2:1. Самая низкая в этом наборе — GPT-5.6 Luna по $0,87 за 1М смешанных токенов.
Методология
Ограничения этого сравнения
Результаты Индекса Искусственного Анализа получены с помощью одного независимого хаба. Точная конфигурация модели сохраняется для каждого результата.
Сценарии стоимости токенов умножают опубликованные цены на входные и выходные данные на введенную вами нагрузку. Они не включают инструменты, хранение, запись в кэш и скидки провайдера.
Отметка общей таблицы означает, что источник опубликовал сравниваемые модели в одной таблице. Отметка того же теста означает, что имя бенчмарка совпадает, но источник или конфигурация различаются.
Отсутствие данных не является низким результатом. Модели без совместимого публичного результата остаются без ранжирования до публикации воспроизводимого результата.
Наши визуальные прогоны Mantis представляют собой отдельный слой доказательств с тем же запросом. Используйте сравнение на живом прогоне, чтобы напрямую оценить качество сборки.