DeepSeek

Уровень B · Специализированные модели или модели второго выбора.

DeepSeek V4 Flash

Используйте DeepSeek V4 Flash для дешевого планирования, каркаса и грубой реализации, которые будут подвергнуты полной проверке.

Проверенные данные о модели

Идентичность, ограничения и цены

Источник провайдера · проверено 01.09.2026 ↗
Статус
Текущая
ID модели API
deepseek-v4-flash
Контекст
1M
Максимальный вывод
384K
Лицензия
Не подтверждено публично
Способ доступа
Не подтверждено публично
Модальности
Не подтверждено публично
Аппаратное обеспечение
Не подтверждено публично
Цена API / 1 млн токенов
$0,14 за ввод · $0,0028 за кэшированный ввод · $0,28 за вывод

Визуальные тесты с одинаковым промптом

Просмотреть фактические прогонки

Откройте сгенерированную сцену для тестирования или сравните этот промпт с другой моделью.

11 запусков

Симулятор полета на метле в Хогвартсе

Тестирование сцены полета на метле: глубина, визуальные подсказки движения, масштаб замка и фантастическое настроение.

Симулятор механических часов

Интерактивное тестирование часов: механическая читаемость, точное относительное движение и управление в 3D в реальном времени.

Симулятор Требушета Штормграда

Тестирование осадного моделирования Counterweight с проверкой связанных механизмов, предсказанием траектории, камерами для снарядов и интерактивной настройкой.

Редакционный вердикт

Где подходит эта модель

Вернуться ко всем тестам →

DeepSeek V4 Flash — это бюджетный вариант в августовском списке. Команда потратила около 1 доллара на общий визуальный набор, в то время как некоторые другие запуски модели стоили примерно 25–40 долларов, но несколько результатов все же показывали видимые дефекты.

Лучшее для

  • Дешевое ежедневное использование
  • Мозговой штурм в режиме плана
  • Строительные каркасы и черновые наброски деталей
  • Нагрузки, которые могут требовать мгновенного пополнения кредита

Внимание

  • Видимые визуальные ошибки появились в тестовом выводе
  • Легкая модель по возможностям остается ниже уровня Pro
  • Требует проверки перед запуском в производство

Почему она занимает это место

  1. Зафиксированные расходы составили около 1 доллара за общие запуски. Подсказки, повторные попытки и цены провайдера могут изменить эту цифру.
  2. Видимые дефекты остались, включая нарушение пространственной композиции в запуске Helm’s Deep.
  3. Награды за размещение в Tier B зависят от стоимости и восполняемой ёмкости, а не от качества вывода уровня флагмана.

Доказательства

2026-08-27

Рейтинг редакционной модели Mantis

Основной вывод: DeepSeek V4 Flash в настоящее время находится в Tier B.

Редакционный список за август 2026 года устанавливает DeepSeek V4 Flash на 11-е место.

Открытый исходный код →
2026-06-17

НОВЫЙ рейтинг моделей ИИ для Vibe Coding!

Основной вывод: Используйте DeepSeek V4 Flash для планирования и построения каркасов с низкой стоимостью.

Исторический источник подчеркивал сопровождение и проверку; текущий редакционный список повышает его до уровня B.

Открытый исходный код →

Официальный профиль бенчмарка

Опубликованные результаты за пределами наших визуальных тестов

DeepSeek V4 Flash активирует 13B из 284B параметров с контекстом на 1M токенов. Это официальные результаты V4-Flash Max, которые используют самый большой опубликованный бюджет рассуждений и отличаются от настроек без размышлений и с высокими параметрами.

Источник DeepSeekАпрель 2026Исходный отчет →
Знания

MMLU-Pro

86.2%
STEM рассуждения

GPQA Diamond

88.1%
Рассуждения по коду

LiveCodeBench

91.6%
Полная официальная таблица бенчмарков12 строк с настройками источника и диаграммами коллег
БенчмаркОбластьБаллНастройка / сравнение
MMLU-ProЗнания86.2%Точное совпадение при максимальном усилии рассуждений V4-Flash.
Gemini 3.1 Pro Высокий91.0%
Claude Opus 4.6 Макс89.1%
DeepSeek V4 Pro Max87.5%
GPT-5.4 xHigh87.5%
DeepSeek V4 Flash86.2%
GPQA DiamondSTEM рассуждения88.1%Pass@1 при максимальном усилии рассуждений V4-Flash.
Gemini 3.1 Pro Высокий94.3%
GPT-5.4 xHigh93.0%
Claude Opus 4.6 Макс91.3%
DeepSeek V4 Pro Max90.1%
DeepSeek V4 Flash88.1%
LiveCodeBenchРассуждения по коду91.6%Pass@1 при максимальном усилии рассуждений V4-Flash.
DeepSeek V4 Pro Max93.5%
Gemini 3.1 Pro Высокий91.7%
DeepSeek V4 Flash91.6%
Kimi K2.6 Размышления89.6%
Claude Opus 4.6 Макс88.8%
HMMT Февраль 2026Математика94.8%Pass@1 при максимальном усилии рассуждений V4-Flash.
GPT-5.4 xHigh97.7%
Claude Opus 4.6 Макс96.2%
DeepSeek V4 Pro Max95.2%
DeepSeek V4 Flash94.8%
IMOAnswerBenchМатематические рассуждения88.4%Pass@1 при максимальном усилии рассуждений V4-Flash.
GPT-5.4 xHigh91.4%
DeepSeek V4 Pro Max89.8%
DeepSeek V4 Flash88.4%
Kimi K2.6 Размышления86.0%
MRCR 1MДлинный контекст78.7%Средний коэффициент совпадений при настройке на 1 миллион токенов.
Claude Opus 4.6 Макс92.9%
DeepSeek V4 Pro Max83.5%
DeepSeek V4 Flash78.7%
Gemini 3.1 Pro Высокий76.3%
Terminal-Bench 2.0Агентное кодирование56.9%Точность в официальной таблице сравнения DeepSeek.
GPT-5.4 xHigh75.1%
Gemini 3.1 Pro Высокий68.5%
DeepSeek V4 Pro Max67.9%
Kimi K2.6 Размышления66.7%
DeepSeek V4 Flash56.9%
SWE-bench ПровереноАгентное кодирование79.0%Уровень решаемости в официальной таблице сравнения DeepSeek.
Claude Opus 4.6 Макс80.8%
DeepSeek V4 Pro Max80.6%
Gemini 3.1 Pro Высокий80.6%
DeepSeek V4 Flash79.0%
SWE-bench ProАгентное кодирование52.6%Уровень решаемости в официальной таблице сравнения DeepSeek.
Kimi K2.6 Размышления58.6%
GLM 5.1 Размышления58.4%
GPT-5.4 xHigh57.7%
DeepSeek V4 Pro Max55.4%
DeepSeek V4 Flash52.6%
BrowseCompВеб-исследование73.2%Pass@1 в официальной таблице сравнения DeepSeek.
Gemini 3.1 Pro Высокий85.9%
Claude Opus 4.6 Макс83.7%
DeepSeek V4 Pro Max83.4%
DeepSeek V4 Flash73.2%
MCP AtlasИспользование инструментов69.0%Pass@1 в официальной таблице сравнения DeepSeek.
DeepSeek V4 Pro Max73.6%
GLM 5.1 Размышления71.8%
Gemini 3.1 Pro Высокий69.2%
DeepSeek V4 Flash69.0%
ToolathlonИспользование инструментов47.8%Pass@1 в официальной таблице сравнения DeepSeek.
GPT-5.4 xHigh54.6%
DeepSeek V4 Pro Max51.8%
Kimi K2.6 Размышления50.0%
DeepSeek V4 Flash47.8%