OpenAI

Уровень B · Специализированные модели или модели второго выбора.

GPT-5.5

Очень хорошая модель доставки, которую превзошла более дешевая Terra.

Проверенные данные о модели

Идентичность, ограничения и цены

Источник провайдера · проверено 01.09.2026 ↗
Статус
Текущая
ID модели API
gpt-5.5
Контекст
1.05M
Максимальный вывод
128K
Лицензия
Не подтверждено публично
Способ доступа
Не подтверждено публично
Модальности
Не подтверждено публично
Аппаратное обеспечение
Не подтверждено публично
Цена API / 1 млн токенов
$5 входные данные · $0,5 кэшированные входные данные · $30 выходные данные

Визуальные тесты с одинаковым промптом

Просмотреть фактические прогонки

Откройте сгенерированную сцену для тестирования или сравните этот промпт с другой моделью.

9 прогонок

Симулятор полета на метле в Хогвартсе

Тестирование сцены полета на метле: глубина, визуальные подсказки движения, масштаб замка и фантастическое настроение.

Редакционный вердикт

Где подходит эта модель

Вернуться ко всем тестам →

GPT-5.5 по-прежнему пишет чистый код и хорошо подходит для инструментов OpenAI, но запись августа рассматривает его как реликт предыдущего поколения: Terra примерно вдвое дешевле по цене API в текущем каталоге и теперь является повседневным инструментом команды.

Лучшее для

  • Режим планирования
  • Проекты архитектуры
  • Рабочие процессы, интегрированные с OpenAI
  • Более короткие задачи кодирования

Внимание

  • Накладные расходы на рассуждения могут заполнять контекст
  • Может отклоняться без явных целей
  • Может добавлять функции, которые вы не просили

Почему она занимает это место

  1. Видео хвалит его режим планирования как один из лучших протестированных вариантов.
  2. Для работы с кодом на длительные горизонты модель может чрезмерно усложнять работу и входить в зону риска окна контекста.
  3. Новый вариант Terra теперь снижает его практическую роль, поэтому GPT-5.5 остается в категории B, а не продвигается выше.

Доказательства

2026-08-27

Рейтинг редакционной модели Mantis

Основной вывод: GPT-5.5 в настоящее время находится в категории B.

Редакционный список за август 2026 года ставит GPT-5.5 на 13-е место.

Открытый исходный код →
2026-06-17

НОВЫЙ рейтинг моделей ИИ для Vibe Coding!

Основной вывод: Используйте GPT-5.5 в режиме планирования, а не в качестве стандарта для длительного кодирования.

В исходном видео говорится, что он сильный и чистый, но чрезмерно обдумывает и тратит слишком много контекста на расширенные сборки.

Открытый исходный код →

Официальный профиль бенчмарка

Опубликованные результаты за пределами наших визуальных тестов

Строки GPT-5.5 объединяют эталонные показатели запуска OpenAI с общими строками сравнения GPT-5.6 там, где это делает оценку напрямую сопоставимой с новыми моделями.

Источник OpenAIМай 2026Исходный отчет →
Кодирование

SWE-bench Pro

58.6%
Агентное кодирование

Terminal-Bench 2.1

85.6%
Использование компьютера

OSWorld 2.0

47.5%
Полная официальная таблица бенчмарков12 строк с настройками источника и диаграммами коллег
БенчмаркОбластьБаллНастройка / сравнение
SWE-bench ProКодирование58.6%Показатель запуска OpenAI GPT-5.5; общая таблица сравнения GPT-5.6 сообщает 59,4% при сравнительном прогоне.
Claude Fable 580.0%
Claude Opus 4.869.2%
GPT-5.6 Sol64.6%
GPT-5.6 Terra63.4%
GPT-5.6 Luna62.7%
GPT-5.558.6%
Gemini 3.1 Pro54.2%
Terminal-Bench 2.1Агентное кодирование85.6%Общая таблица сравнения GPT-5.6.
GPT-5.6 Sol88.8%
GPT-5.6 Terra87.4%
GPT-5.585.6%
GPT-5.6 Luna84.7%
Claude Fable 583.1%
Claude Opus 4.878.9%
Gemini 3.1 Pro70.7%
OSWorld 2.0Использование компьютера47.5%Общая таблица сравнения GPT-5.6.
GPT-5.6 Sol62.6%
Claude Opus 4.854.8%
GPT-5.6 Terra50.2%
GPT-5.547.5%
GPT-5.6 Luna45.6%
Проверено OSWorldИспользование компьютера78.7%Показатель запуска OpenAI GPT-5.5.
Claude Fable 585.0%
Claude Opus 4.883.4%
GPT-5.578.7%
Gemini 3.5 Flash78.4%
BrowseCompИспользование инструментов84.4%Общая таблица сравнения GPT-5.6 и результат запуска GPT-5.5.
GPT-5.6 Sol Ultra92.2%
GPT-5.6 Sol90.4%
Claude Mythos 588.0%
Claude Mythos Preview87.9%
GPT-5.6 Terra87.5%
Gemini 3.1 Pro85.9%
GPT-5.584.4%
Claude Opus 4.884.3%
BenchCADКомпьютерное проектирование44.4%Оценка Vision2Code без Python-инструмента из общей таблицы GPT-5.6.
GPT-5.6 Sol70.6%
GPT-5.6 Luna63.1%
GPT-5.6 Terra62.3%
GPT-5.544.4%
Claude Mythos 538.4%
Claude Mythos Preview35.5%
Claude Opus 4.827.3%
BenchCAD с Python-инструментомИспользование инструментов59.4%Оценка Vision2Code с Python-инструментом из общей таблицы GPT-5.6.
GPT-5.6 Sol83.4%
GPT-5.6 Terra78.2%
GPT-5.6 Luna73.9%
GPT-5.559.4%
Claude Mythos 556.7%
Claude Mythos Preview56.4%
Claude Opus 4.848.1%
GPQA DiamondАкадемическое рассуждение93.6%Результат научного рассуждения OpenAI и общая таблица GPT-5.6.
GPT-5.6 Sol94.6%
Gemini 3.1 Pro94.3%
Claude Mythos 594.1%
GPT-5.593.6%
GPT-5.6 Terra92.9%
Claude Fable 592.6%
GPT-5.6 Luna92.3%
Claude Opus 4.892.0%
FrontierMath Уровень 1-3 v2Математика85.3%Общая таблица сравнения GPT-5.6.
GPT-5.6 Sol89.0%
Claude Fable 587.0%
GPT-5.585.3%
GPT-5.6 Terra84.9%
Claude Opus 4.880.0%
GPT-5.6 Luna78.6%
Gemini 3.1 Pro59.6%
FrontierMath Уровень 4 v2Математика72.5%Общая таблица сравнения GPT-5.6.
Claude Fable 587.8%
GPT-5.6 Sol83.0%
GPT-5.572.5%
GPT-5.6 Terra68.3%
GPT-5.6 Luna58.5%
Claude Opus 4.856.1%
GDPvalПрофессиональная работа84.9%Показатель запуска OpenAI GPT-5.5.
CyberGymКибербезопасность81.8%Показатель запуска OpenAI GPT-5.5.