Рейтинг последних ИИ-моделей (Tier List)
Список уровней, обновлённый на середину августа 2026 года
ИИ сильно изменился всего за несколько месяцев. Команда разделилась, чтобы тестировать разные модели каждый день, и этот список уровней — результат. Речь идёт не о сырых результатах бенчмарков. Речь о том, что действительно имеет смысл использовать при создании реальных проектов и отслеживании затрат.
Главным выбором по-прежнему остается Fable 5. Для планирования и обсуждения идей она на уровне S+. Она гиперинтеллектуальна, но ленивa, когда речь идет о кодировании. Большинство задач по кодированию она передает другим моделям, поэтому используйте её для планирования дня, продумывания задачи или умного общения. GPT-5.6 Solo — это другая модель уровня S. Она используется ежедневно для интенсивной работы с кодом и даже для разработки приложений. Команда создала dogdog с её помощью. Она не самая гениальная модель, но достаточно умна для большинства задач и часто получает сбросы использования от OpenAI. Это делает её сейчас отличным соотношением цены и качества.
Новые претенденты
Grok 4.6 вышел на этой неделе, и это больше не шутка. После того как Илон Маск купил Cursor, обучение после выпуска значительно улучшилось. Команда разделилась во мнениях, куда его поставить. Один говорит, что это S-уровень, потому что он чрезвычайно быстрый, особенно для агентов. Другой говорит, что это A-уровень, потому что он теряет точность в середине задач, а интеллект ощущается на уровне GPT-5.6 Solo, не лучше. Практическая оценка: A+ для программирования и S для агентов, когда важна скорость. Если у вас есть X Premium, Grok включён, и запуск Hermes на нём достаточно быстр, чтобы реально изменить ситуацию.
DeepSeek V4 Flash и V4 Pro — это дешевые китайские модели, которых ждали в команде. Полный запуск бенчмарка стоил около $1, по сравнению с $25–$40 для других моделей. Замок, который он построил, был плавающим, что ожидаемо для легкой модели, но за $1 это нормально. V4 Pro, вероятно, находится на уровне A, а Flash — на уровне B. Kimi K3 все еще умна и близка к S-уровню, но теперь она уже не дешевая. Команда исчерпала месячный лимит использования к 14 августа и застряла. Пока Kimi не станет дешевле или не перейдет на американские серверы, она находится между A и S. GLM 5.3 и Qwen 3.8 Max также находятся на низком уровне A. GLM кажется умнее, чем Kimi, но все еще дорогая. Qwen Max очень хорош в веб-дизайне, потому что обучен именно на такой работе.
Что делать на самом деле
Если вы новичок в ИИ, попробуйте Fable 5, Grok 4.6 или GPT-5.6 Solo. Не экономьте на больших решениях. Команда упомянула фермера, который спросил у более старой версии ИИ, чем обрабатывать посевы, и потерял поле. Более старые модели сильнее вводят в заблуждение. Для ежедневной работы с веб-сайтами и кодом DeepSeek становится стандартом, потому что это дешево, и вы можете пополнять кредиты всякий раз, когда нужно. Не покупайте годовые планы. Гонка развивается слишком быстро, и модель, которая в пять раз умнее, может появиться через месяц. Платите помесячно, проверяйте сбросы и подбирайте модель под задачу.
