MiniMax

Уровень C · Ситуативные инструменты.

MiniMax M3

Бывший ежедневный инструмент, который отстал от августа.

Проверенные данные о модели

Идентичность, ограничения и цены

Источник провайдера · проверено 01.09.2026 ↗
Статус
Текущая
ID модели API
MiniMax-M3
Контекст
1M
Максимальный вывод
Не подтверждено публично
Лицензия
Не подтверждено публично
Способ доступа
Не подтверждено публично
Модальности
Не подтверждено публично
Аппаратное обеспечение
Не подтверждено публично
Цена API / 1 млн токенов
$0,3 за ввод · $0,06 за кэшированный ввод · $1,2 за вывод

Показанные ставки применяются к 512К токенов ввода; для более длинных подсказок используется более высокий тариф провайдера.

Рекомендуется для этого руководства

MiniMax

Используйте ту же семью MiniMax, что тестировалась на этой странице. Проверьте текущий план и доступ к модели перед подпиской.

Лучшее для: Работа с длинным контекстом и экономичное выполнение

Ознакомьтесь с планами MiniMaxПартнерская ссылка. Она поддерживает Mantis без дополнительных затрат для вас.

Визуальные тесты с одинаковым промптом

Просмотреть фактические прогонки

Откройте сгенерированную сцену для тестирования или сравните этот промпт с другой моделью.

11 запусков

Симулятор полета на метле в Хогвартсе

Тестирование сцены полета на метле: глубина, визуальные подсказки движения, масштаб замка и фантастическое настроение.

Симулятор механических часов

Интерактивное тестирование часов: механическая читаемость, точное относительное движение и управление в 3D в реальном времени.

Симулятор Требушета Штормграда

Тестирование осадного моделирования Counterweight с проверкой связанных механизмов, предсказанием траектории, камерами для снарядов и интерактивной настройкой.

Редакционный вердикт

Где подходит эта модель

Вернуться ко всем тестам →

MiniMax M3 теперь находится в группе C. Еще несколько месяцев назад это был один из любимых командой дешевых ежедневных инструментов, но новые модели расширили разрыв: теперь M3 требует больше проверки на ошибки, может с уверенностью утверждать, что работа выполнена, когда это не так, и не такой дешевый, как DeepSeek, и не такой способный, как Kimi.

Лучшее для

  • Эксперименты с низким риском
  • Существующие рабочие процессы MiniMax с тщательной проверкой
  • Дешевая продолжительная работа, когда новые варианты недоступны

Внимание

  • Частые ошибки и ложные утверждения о завершении при использовании командой
  • Не получил такой же недавней качественной эволюции, как у коллег
  • Используйте более сильного рецензента для важной работы
  • Не используйте для важных жизненных решений

Почему она занимает это место

  1. Команда активно использовала MiniMax M3 в течение двух-трех месяцев, потому что это было достаточно дешево для спекулятивных проектов.
  2. К августу команда тратила слишком много времени на проверку ошибок и уверенных, но неточных утверждений о завершении.
  3. Теперь DeepSeek выигрывает роль цены, а Kimi выигрывает роль возможностей, оставляя M3 как ситуативный вариант уровня C.

Доказательства

2026-08-27

Рейтинг редакционной модели Mantis

Основной вывод: В настоящее время MiniMax M3 занимает уровень C.

Редакционный список на август 2026 года ставит MiniMax M3 на 15-е место.

Открытый исходный код →
2026-06-17

НОВЫЙ рейтинг моделей ИИ для Vibe Coding!

Основной вывод: MiniMax M3 требует сильного контроля и присмотра; августовский список больше не рассматривает его как актуальную рабочую лошадку.

Старые источники объясняют, почему команда приняла M3, в то время как новые записи показывают, почему его обошли более современные аналоги.

Открытый исходный код →

Официальный профиль бенчмарка

Опубликованные результаты за пределами наших визуальных тестов

MiniMax публикует результаты M3 по программированию, работе с браузером, использованию инструментов, электронным таблицам и управлению компьютером. Его лучший относительный результат в официальной сравнительной таблице — SVG-Bench; показатели по терминалу и управлению ОС остаются ниже, чем у крупнейших закрытых моделей.

Источник MiniMaxИюнь 2026Исходный отчет →
Агентное кодирование

SWE-bench Pro

59.0%
Терминальные агенты

Terminal-Bench 2.1

66.0%
Полноценное программирование

VIBE V2

50.1%
Полная официальная таблица бенчмарков11 строк с настройками источника и графиками сравнения с ровесниками
БенчмаркОбластьБаллНастройка / сравнение
SWE-bench ProАгентное кодирование59.0%Инфраструктура MiniMax с каркасом Claude Code и логикой оценки, согласованной с официальной.
Claude Opus 4.764.3%
MiniMax M359.0%
GPT-5.558.6%
Gemini 3.1 Pro54.2%
Terminal-Bench 2.1Терминальные агенты66.0%8C16G песочница, двухчасовой тайм-аут, ограничение вывода 128K, Terminus 2.
GPT-5.578.2%
Gemini 3.1 Pro70.0%
Claude Opus 4.766.1%
MiniMax M366.0%
VIBE V2Полноценное программирование50.1%Внутренний бенчмарк сборки с нуля с Claude Code и среднее значение по трем прогонкам.
Claude Opus 4.755.8%
GPT-5.550.5%
MiniMax M350.1%
Gemini 3.1 Pro28.0%
SVG-СтендВизуальное кодирование63.7%Внутренние задачи по созданию и редактированию текста/изображений с проверкой визуализации VLM; среднее значение по трем прогонкам.
MiniMax M363.7%
Claude Opus 4.762.3%
Gemini 3.1 Pro59.2%
GPT-5.558.2%
KernelBench HardЯдра GPU28.8%Claude Code на NVIDIA Blackwell sm_120; среднее значение отправленных TFLOPs от теоретического пика по девяти вопросам.
Claude Opus 4.730.7%
MiniMax M328.8%
GPT-5.520.9%
Gemini 3.1 Pro18.6%
BrowseCompВеб-исследование83.5%Фреймворк агента WebExplorer с историей, обрезанной выше 64K токенов.
Gemini 3.1 Pro85.9%
GPT-5.584.4%
MiniMax M383.5%
Claude Opus 4.779.3%
Рубрики GDPvalПрофессиональная работа74.7%Публичные случаи и рубрики GDPval с покомпонентным начислением баллов в соответствии с GDPval-AA.
GPT-5.580.6%
Claude Opus 4.779.8%
MiniMax M374.7%
Gemini 3.1 Pro57.8%
BankerToolBenchФинансовые инструменты76.1%Публичный набор данных; Claude Code, кроме GPT использует Codex; судья MiniMax M2.7.
Claude Opus 4.781.3%
MiniMax M376.1%
GPT-5.570.0%
Gemini 3.1 Pro67.0%
MCP AtlasИспользование инструментов74.2%Официальный публичный набор и кодовая база с Gemini 2.5 Pro в качестве судьи.
Claude Opus 4.777.0%
GPT-5.575.3%
MiniMax M374.2%
Gemini 3.1 Pro69.2%
Проверено OSWorldИспользование компьютера75.2%361 образец, официальная кодовая база, 1920x1080, относительные координаты и ограничение в 200 шагов.
Claude Opus 4.782.8%
GPT-5.578.7%
Gemini 3.1 Pro76.2%
MiniMax M375.2%
SWE-эффективностьЭффективность кодирования34.8%Открытый набор данных и рабочий процесс MiniMax с двухчасовым тайм-аутом в Claude Code.