OpenAI

Уровень C · Ситуативные инструменты.

GPT-5.6 Luna

Запасной вариант доставки, к которому команда редко обращается, пока Terra остается доступной.

Проверенные данные о модели

Идентичность, ограничения и цены

Источник провайдера · проверено 01.09.2026 ↗
Статус
Текущая
ID модели API
gpt-5.6-luna
Контекст
1.05M
Максимальный вывод
128K
Лицензия
Не подтверждено публично
Способ доступа
Не подтверждено публично
Модальности
Не подтверждено публично
Аппаратное обеспечение
Не подтверждено публично
Цена API / 1 млн токенов
$1 за ввод · $0.1 за кэшированный ввод · $6 за вывод

Визуальные тесты с одинаковым промптом

Просмотреть фактические прогонки

Откройте сгенерированную сцену для тестирования или сравните этот промпт с другой моделью.

9 прогонок

Симулятор полета на метле в Хогвартсе

Тестирование сцены полета на метле: глубина, визуальные подсказки движения, масштаб замка и фантастическое настроение.

Редакционный вердикт

Где подходит эта модель

Вернуться ко всем тестам →

GPT-5.6 Luna находится в C-уровне. Команда рассматривает её как модель для доставки, но на практике использует Terra при низком уровне рассуждений для той же скучной работы и не нашла веской причины выбирать Luna в первую очередь.

Лучшее для

  • Работа по резервной доставке
  • Низкорисковые ограниченные задачи
  • Случаи, когда Luna является доступным вариантом OpenAI

Внимание

  • Пока мало непосредственного использования командой
  • Terra на низком уровне рассуждений в настоящее время перекрывает её роль
  • Не перенаправляйте на неё важные решения без проверки

Почему она занимает это место

  1. Luna попадает в C, потому что её предполагаемая роль в доставке слишком сильно перекрывается с Terra с низким уровнем рассуждений.
  2. Команда сказала, что редко вынуждена использовать Luna, потому что Terra остаётся доступной и хорошо справляется с рутинной работой.
  3. Это классификация, основанная на использовании, а не утверждение, что Luna провалила полный набор тестов.

Доказательства

2026-08-27

Рейтинг редакционной модели Mantis

Основной вывод: GPT-5.6 Luna в настоящее время размещена в уровне C.

В редакционном составе за август 2026 года GPT-5.6 Luna занимает 14-е место.

Открытый исходный код →

Официальный профиль бенчмарка

Опубликованные результаты за пределами наших визуальных тестов

OpenAI описывает Luna как самый быстрый и экономичный вариант GPT-5.6. Эти строки используют общую таблицу сравнения GPT-5.6, чтобы результаты можно было сопоставить с Sol, Terra, GPT-5.5, Claude и Gemini, где опубликовано.

Источник OpenAIИюль 2026Исходный отчет →
Кодирование

SWE-bench Pro

62.7%
Агентное кодирование

Terminal-Bench 2.1

84.7%
Использование компьютера

OSWorld 2.0

45.6%
Полная официальная таблица бенчмарков9 строк с исходными настройками и графиками коллег
БенчмаркОбластьБаллНастройка / сравнение
SWE-bench ProКодирование62.7%Общая сравнительная таблица OpenAI GPT-5.6.
Claude Fable 580.0%
Claude Opus 4.869.2%
GPT-5.6 Sol64.6%
GPT-5.6 Terra63.4%
GPT-5.6 Luna62.7%
GPT-5.559.4%
Gemini 3.1 Pro54.2%
Terminal-Bench 2.1Агентное кодирование84.7%Общая сравнительная таблица OpenAI GPT-5.6.
GPT-5.6 Sol88.8%
GPT-5.6 Terra87.4%
GPT-5.585.6%
GPT-5.6 Luna84.7%
Claude Fable 583.1%
Claude Opus 4.878.9%
Gemini 3.1 Pro70.7%
OSWorld 2.0Использование компьютера45.6%Сравнительная таблица производительности при высокой нагрузке на компьютер.
GPT-5.6 Sol62.6%
Claude Opus 4.854.8%
GPT-5.6 Terra50.2%
GPT-5.547.5%
GPT-5.6 Luna45.6%
BrowseCompИспользование инструментов83.3%Таблица сравнения агентов для просмотра с высокой нагрузкой.
GPT-5.6 Sol Ultra92.2%
GPT-5.6 Sol90.4%
Claude Mythos 588.0%
Claude Mythos Preview87.9%
GPT-5.6 Terra87.5%
Gemini 3.1 Pro85.9%
GPT-5.584.4%
Claude Opus 4.884.3%
BenchCADКомпьютерное проектирование63.1%Результат Vision2Code без инструмента Python.
GPT-5.6 Sol70.6%
GPT-5.6 Luna63.1%
GPT-5.6 Terra62.3%
GPT-5.544.4%
Claude Mythos 538.4%
Claude Mythos Preview35.5%
Claude Opus 4.827.3%
BenchCAD с Python-инструментомИспользование инструментов73.9%Результат Vision2Code с инструментом Python.
GPT-5.6 Sol83.4%
GPT-5.6 Terra78.2%
GPT-5.6 Luna73.9%
GPT-5.559.4%
Claude Mythos 556.7%
Claude Mythos Preview56.4%
Claude Opus 4.848.1%
GPQA DiamondАкадемическое рассуждение92.3%Общая таблица бенчмарков для рассуждений.
GPT-5.6 Sol94.6%
Gemini 3.1 Pro94.3%
Claude Mythos 594.1%
GPT-5.593.6%
GPT-5.6 Terra92.9%
Claude Fable 592.6%
GPT-5.6 Luna92.3%
Claude Opus 4.892.0%
FrontierMath Уровень 1-3 v2Математика78.6%Общая таблица бенчмарков для рассуждений.
GPT-5.6 Sol89.0%
Claude Fable 587.0%
GPT-5.585.3%
GPT-5.6 Terra84.9%
Claude Opus 4.880.0%
GPT-5.6 Luna78.6%
Gemini 3.1 Pro59.6%
FrontierMath Уровень 4 v2Математика58.5%Общая таблица бенчмарков для рассуждений.
Claude Fable 587.8%
GPT-5.6 Sol83.0%
GPT-5.572.5%
GPT-5.6 Terra68.3%
GPT-5.6 Luna58.5%
Claude Opus 4.856.1%