Курсор
Composer 2.5
Запуски бенчмарка версии 2.5 на общих визуальных подсказках Mantis.
Проверенные данные о модели
Идентичность, ограничения и цены
- Статус
- Текущая
- ID модели API
- Не подтверждено публично
- Контекст
- Не подтверждено публично
- Максимальный вывод
- Не подтверждено публично
- Лицензия
- Не подтверждено публично
- Способ доступа
- Не подтверждено публично
- Модальности
- Не подтверждено публично
- Аппаратное обеспечение
- Не подтверждено публично
- Цена API / 1 млн токенов
- $0.5 вход · $— кэшированный вход · $2.5 выход
Стандартный режим; Cursor также предлагает более быстрый режим $3 вход / $15 выход.
Визуальные тесты с одинаковым промптом
Просмотреть фактические прогонки
Откройте сгенерированную сцену для тестирования или сравните этот промпт с другой моделью.

Роханская крепость
Тестирование сцены осады крепости: масштаб, освещение, архитектура и кинематографическая атмосфера.

Симулятор полета на метле в Хогвартсе
Тестирование сцены полета на метле: глубина, визуальные подсказки движения, масштаб замка и фантастическое настроение.

Jabberwock
Тестирование встречи в стиле тёмного фэнтези: дизайн существ, настроение леса и постановка повествования.

Мир с низкой полигонажностью
Стилизованная островная сцена для тестирования композиции, цвета и низкополигонального миростроения.

Офисная жизнь
Офисная виньетка для тестирования логики повседневной сцены, объектов и достоверных офисных деталей.

Петри
Микроскопическая экосистема для тестирования органических форм, научной ясности и клеточных деталей.

Симулятор вселенной
Космическая система для тестирования орбитальной структуры, светящихся тел, масштаба и читаемости симуляции.

Вайс Сити
Неоновый прибрежный город для тестирования транспортных средств, архитектуры, атмосферы и плотной городской планировки.

Сборка по «Yingzao Fashi»
Сцена сборки древесины для тестирования структуры, соединений, порядка строительства и материала.
Официальный профиль бенчмарка
Как Composer 2.5 работает на тестах кодирования.
Cursor продолжил обучение Kimi K2.5 для Composer 2.5 и сообщает о приросте показателей по сравнению с Composer 2 в агентских, многоязычных задачах и более сложном кодировании. В таблице релизов публикуются три оценки.
Terminal-Bench 2.0
69.3%SWE-bench Многоязычное
79.8%CursorBench v3.1 более сложные задачи
63.2%Полная официальная таблица бенчмарков3 строки с исходными настройками и графиками сверстников
| Бенчмарк | Область | Балл | Настройка / сравнение |
|---|---|---|---|
| Terminal-Bench 2.0 | Агентное кодирование | 69.3% | Результат таблицы релизов Cursor; метка усилий Composer или подробные настройки тестовой среды не публикуются. |
| SWE-bench Многоязычное | Многоязычное кодирование | 79.8% | Результат таблицы релизов Cursor; метка усилий Composer не публикуется. |
| CursorBench v3.1 более сложные задачи | Сложное агентское кодирование | 63.2% | Собственный бенчмарк Cursor для более сложных задач; метка усилий Composer не публикуется.Курсор отмечает сравнительные показатели Opus 4.7 и GPT-5.5 по самоотчетности. |