MiniMax
MiniMax M3
Бывший ежедневный инструмент, который отстал от августа.
Проверенные данные о модели
Идентичность, ограничения и цены
- Статус
- Текущая
- ID модели API
MiniMax-M3- Контекст
- 1M
- Максимальный вывод
- Не подтверждено публично
- Лицензия
- Не подтверждено публично
- Способ доступа
- Не подтверждено публично
- Модальности
- Не подтверждено публично
- Аппаратное обеспечение
- Не подтверждено публично
- Цена API / 1 млн токенов
- $0,3 за ввод · $0,06 за кэшированный ввод · $1,2 за вывод
Показанные ставки применяются к 512К токенов ввода; для более длинных подсказок используется более высокий тариф провайдера.
Рекомендуется для этого руководства
MiniMax
Используйте ту же семью MiniMax, что тестировалась на этой странице. Проверьте текущий план и доступ к модели перед подпиской.
Лучшее для: Работа с длинным контекстом и экономичное выполнение
Ознакомьтесь с планами MiniMaxПартнерская ссылка. Она поддерживает Mantis без дополнительных затрат для вас.Визуальные тесты с одинаковым промптом
Просмотреть фактические прогонки
Откройте сгенерированную сцену для тестирования или сравните этот промпт с другой моделью.

Роханская крепость
Тестирование сцены осады крепости: масштаб, освещение, архитектура и кинематографическая атмосфера.

Симулятор полета на метле в Хогвартсе
Тестирование сцены полета на метле: глубина, визуальные подсказки движения, масштаб замка и фантастическое настроение.

Jabberwock
Тестирование встречи в стиле тёмного фэнтези: дизайн существ, настроение леса и постановка повествования.

Мир с низкой полигонажностью
Стилизованная островная сцена для тестирования композиции, цвета и низкополигонального миростроения.

Симулятор механических часов
Интерактивное тестирование часов: механическая читаемость, точное относительное движение и управление в 3D в реальном времени.

Офисная жизнь
Офисная виньетка для тестирования логики повседневной сцены, объектов и достоверных офисных деталей.

Петри
Микроскопическая экосистема для тестирования органических форм, научной ясности и клеточных деталей.

Симулятор Требушета Штормграда
Тестирование осадного моделирования Counterweight с проверкой связанных механизмов, предсказанием траектории, камерами для снарядов и интерактивной настройкой.

Симулятор вселенной
Космическая система для тестирования орбитальной структуры, светящихся тел, масштаба и читаемости симуляции.

Вайс Сити
Неоновый прибрежный город для тестирования транспортных средств, архитектуры, атмосферы и плотной городской планировки.

Сборка по «Yingzao Fashi»
Сцена сборки древесины для тестирования структуры, соединений, порядка строительства и материала.
Официальный профиль бенчмарка
Опубликованные результаты за пределами наших визуальных тестов
MiniMax публикует результаты M3 по программированию, работе с браузером, использованию инструментов, электронным таблицам и управлению компьютером. Его лучший относительный результат в официальной сравнительной таблице — SVG-Bench; показатели по терминалу и управлению ОС остаются ниже, чем у крупнейших закрытых моделей.
SWE-bench Pro
59.0%Terminal-Bench 2.1
66.0%VIBE V2
50.1%Полная официальная таблица бенчмарков11 строк с настройками источника и графиками сравнения с ровесниками
| Бенчмарк | Область | Балл | Настройка / сравнение |
|---|---|---|---|
| SWE-bench Pro | Агентное кодирование | 59.0% | Инфраструктура MiniMax с каркасом Claude Code и логикой оценки, согласованной с официальной. |
| Terminal-Bench 2.1 | Терминальные агенты | 66.0% | 8C16G песочница, двухчасовой тайм-аут, ограничение вывода 128K, Terminus 2. |
| VIBE V2 | Полноценное программирование | 50.1% | Внутренний бенчмарк сборки с нуля с Claude Code и среднее значение по трем прогонкам. |
| SVG-Стенд | Визуальное кодирование | 63.7% | Внутренние задачи по созданию и редактированию текста/изображений с проверкой визуализации VLM; среднее значение по трем прогонкам. |
| KernelBench Hard | Ядра GPU | 28.8% | Claude Code на NVIDIA Blackwell sm_120; среднее значение отправленных TFLOPs от теоретического пика по девяти вопросам. |
| BrowseComp | Веб-исследование | 83.5% | Фреймворк агента WebExplorer с историей, обрезанной выше 64K токенов. |
| Рубрики GDPval | Профессиональная работа | 74.7% | Публичные случаи и рубрики GDPval с покомпонентным начислением баллов в соответствии с GDPval-AA. |
| BankerToolBench | Финансовые инструменты | 76.1% | Публичный набор данных; Claude Code, кроме GPT использует Codex; судья MiniMax M2.7. |
| MCP Atlas | Использование инструментов | 74.2% | Официальный публичный набор и кодовая база с Gemini 2.5 Pro в качестве судьи. |
| Проверено OSWorld | Использование компьютера | 75.2% | 361 образец, официальная кодовая база, 1920x1080, относительные координаты и ограничение в 200 шагов. |
| SWE-эффективность | Эффективность кодирования | 34.8% | Открытый набор данных и рабочий процесс MiniMax с двухчасовым тайм-аутом в Claude Code. |

Редакционный вердикт
Где подходит эта модель
MiniMax M3 теперь находится в группе C. Еще несколько месяцев назад это был один из любимых командой дешевых ежедневных инструментов, но новые модели расширили разрыв: теперь M3 требует больше проверки на ошибки, может с уверенностью утверждать, что работа выполнена, когда это не так, и не такой дешевый, как DeepSeek, и не такой способный, как Kimi.
Лучшее для
Внимание
Почему она занимает это место
Доказательства
Рейтинг редакционной модели Mantis
Основной вывод: В настоящее время MiniMax M3 занимает уровень C.
Редакционный список на август 2026 года ставит MiniMax M3 на 15-е место.
Открытый исходный код →НОВЫЙ рейтинг моделей ИИ для Vibe Coding!
Основной вывод: MiniMax M3 требует сильного контроля и присмотра; августовский список больше не рассматривает его как актуальную рабочую лошадку.
Старые источники объясняют, почему команда приняла M3, в то время как новые записи показывают, почему его обошли более современные аналоги.
Открытый исходный код →Связанные руководства