Курсор

Composer 2.5

Запуски бенчмарка версии 2.5 на общих визуальных подсказках Mantis.

Проверенные данные о модели

Идентичность, ограничения и цены

Источник провайдера · проверено 01.09.2026 ↗
Статус
Текущая
ID модели API
Не подтверждено публично
Контекст
Не подтверждено публично
Максимальный вывод
Не подтверждено публично
Лицензия
Не подтверждено публично
Способ доступа
Не подтверждено публично
Модальности
Не подтверждено публично
Аппаратное обеспечение
Не подтверждено публично
Цена API / 1 млн токенов
$0.5 вход · $— кэшированный вход · $2.5 выход

Стандартный режим; Cursor также предлагает более быстрый режим $3 вход / $15 выход.

Визуальные тесты с одинаковым промптом

Просмотреть фактические прогонки

Откройте сгенерированную сцену для тестирования или сравните этот промпт с другой моделью.

9 прогонок

Симулятор полета на метле в Хогвартсе

Тестирование сцены полета на метле: глубина, визуальные подсказки движения, масштаб замка и фантастическое настроение.

Официальный профиль бенчмарка

Как Composer 2.5 работает на тестах кодирования.

Cursor продолжил обучение Kimi K2.5 для Composer 2.5 и сообщает о приросте показателей по сравнению с Composer 2 в агентских, многоязычных задачах и более сложном кодировании. В таблице релизов публикуются три оценки.

Исходный код CursorМай 2026Исходный отчет →
Агентное кодирование

Terminal-Bench 2.0

69.3%
Многоязычное кодирование

SWE-bench Многоязычное

79.8%
Сложное агентское кодирование

CursorBench v3.1 более сложные задачи

63.2%
Полная официальная таблица бенчмарков3 строки с исходными настройками и графиками сверстников
БенчмаркОбластьБаллНастройка / сравнение
Terminal-Bench 2.0Агентное кодирование69.3%Результат таблицы релизов Cursor; метка усилий Composer или подробные настройки тестовой среды не публикуются.
GPT-5.582.7%
Claude Opus 4.769.4%
Composer 2.569.3%
Composer 261.7%
SWE-bench МногоязычноеМногоязычное кодирование79.8%Результат таблицы релизов Cursor; метка усилий Composer не публикуется.
Claude Opus 4.780.5%
Composer 2.579.8%
GPT-5.577.8%
Composer 273.7%
CursorBench v3.1 более сложные задачиСложное агентское кодирование63.2%Собственный бенчмарк Cursor для более сложных задач; метка усилий Composer не публикуется.Курсор отмечает сравнительные показатели Opus 4.7 и GPT-5.5 по самоотчетности.
Claude Opus 4.7 макс64.8%
GPT-5.5 очень высокий64.3%
Composer 2.563.2%
Composer 252.2%