AI-модели · Учебник 05
Frontier против моделей с открытым весом: Руководство по принятию решений
Объедините L01–L04 в пять вопросов, которые помогут выбрать модель ИИ для задачи и покажут, когда менять уровень в середине проекта.

0 из 6 завершено
Последнее тестирование и обновление: Июнь 2026
Выбирайте модель по циклу, в котором она будет работать, а не по её пометке уровня. Пять вопросов помогают сузить выбор для любой рабочей нагрузки.
Задача меняет ответ
Выбор сводится к вашему типу задачи.
Возьмите Kimi K2.7 за $5/месяц и напишите письмо с благодарностью. Это работает. Результат соответствует Claude Max за $200/месяц.
Теперь возьмите Kimi для более сложной задачи: разработать многоарендную схему Postgres с безопасностью на уровне строк. Она может это сделать. Вам придётся трижды ловить крайние случаи. Opus ловит их за один раз.
Эта разница как раз и отражается в выборе уровня.
Выбирайте по циклу
Руководство канала во всех случаях Л02, Л03, и Л04 едино: выбирайте по циклу. Способная модель внутри неправильного цикла всё равно остаётся неправильным инструментом. Тот же принцип, который используется при выборе ремня в Hermes L01 также применяется к уровню модели.
Три уровня, три задачи:
- Уровень 1: Frontier (закрытый, дорогой, класса Mythos). Opus 4.8, Fable 5, GPT 5.5, Gemini 3.1 Pro. Сложные одноразовые задачи: новый креативный проект, неоднозначные спецификации, архитектурные решения. $80–$300 в месяц.
- Уровень 2: экономичный (с открытым весом или дешёвый закрытый). Kimi K2.7, DeepSeek V4 Pro, Qwen 3.7 Max/Plus, MiniMax M3, GLM 5.2, Sonnet 4.5. Восемьдесят процентов ежедневной работы: пользовательский интерфейс, зрение, код-ревью, суммаризация, рабочие процессы агента. $5–$40 в месяц.
- Уровень 3: Узкая специализация. Sakana Fugu, Mistral Codestral, DeepSeek Coder. Одна рабочая нагрузка, выполненная исключительно хорошо. Не обобщайте модель уровня 3: выбирайте нишу специально, а не случайно.
По умолчанию уровень 2. Уровень 1 для сложной работы. Уровень 3 только когда ниша соответствует вашей рабочей нагрузке. Этот подход работает почти для всех, почти каждый день.
Пять вопросов перед маршрутизацией
Используйте эту структуру из 5 вопросов, чтобы выбрать подходящий уровень для любой рабочей нагрузки. Отвечайте по порядку.
Вопрос 1: В каком цикле выполняется рабочая нагрузка? Пять циклов охватывают большую часть работы в 2026 году:
| Цикл | Уровень по умолчанию | Модель по умолчанию |
|---|---|---|
| Одноразовое креативное / новое задание | Уровень 1 | Opus 4.8 или Fable 5 |
| Ежедневные вопросы и ответы, суммирование | Уровень 2 | Sonnet 4.5 или Kimi K2.7 |
| Программирование весь день (производство) | Многоуровневый | Sonnet по умолчанию, Opus для сложных задач |
| Агент с долгим горизонтом (часы) | Уровень 2 + агентский каркас | Qwen 3.7 Max или MiniMax M3 |
| Мультимодальный (визуальный интерфейс / UI / изображения) | Специалист уровня 2 | MiniMax M3 или Kimi K2.7 |
Самая большая ошибка начинающих: считать цикл синонимом имени задачи.
Сессия кодирования — это цикл (интерактивная, проверяемая, многошаговая). Одноразовый креативный запрос — это другой цикл (один шаг, без обратной связи по тесту).
Сначала сопоставьте цикл. Модель строится на этом.
Вопрос 2: Какой у вас ежемесячный бюджет? Меньше $20/мес: только Уровень 2. $20–$50/мес: Уровень 2 с редкими переходами на Уровень 1. $50–$200/мес: Уровень 2 по умолчанию плюс маршрутизация на Уровень 1 для самых сложных 10–20% задач.
Более $200/мес: Уровень 1 подходит для ежедневного использования. Проверьте, используете ли вы эту возможность.
Вопрос 3: Насколько воспроизводима рабочая нагрузка? Ежедневные исследовательские сводки, повторяющиеся cron-задания, повторяющиеся вопросы и ответы: Уровень 2, и точка.
Переменные входные данные склоняют вас к Tier 1 или многоуровневой маршрутизации. Однократная творческая работа на реальный срок — это тот случай, когда выигрывает Tier 1.
Вопрос 4: Насколько это срочно? Дни или недели: Tier 2. Часы: Tier 2, если Qwen Max или DeepSeek Flash достаточно быстры. Минуты (срочный одноразовый срок): Tier 1.
Интеллект уровня Mythos имеет значение, когда второй попытки нет.
Вопрос 5: Насколько вы доверяете системе управления? Это вопрос, который люди забывают.
Надежная система управления (Claude для кода, Гермес для агентских циклов) ловит ошибки Tier 2 через проверку.
Новая или экспериментальная система управления не может поймать их: поэтому вы платите премию Tier 1 как страхование. Многоуровневая маршрутизация актуальна Hermes L06.
Когда менять уровни в середине проекта
Tier 2 → Tier 1: три или более попыток с одним и тем же запросом. Задача переходит от рутинной к новой. Или работа критическая для производства, где надежность важнее стоимости.
Уровень 1 → Уровень 2: вы понимаете, что Уровень 1 не делает ничего такого, чего не может Уровень 2. Рабочая нагрузка переходит от новой к рутинной. Или вы тратите $200+/мес на незначительные задачи.
В рамках Уровня 2: форма рабочей нагрузки меняется (кодирование → UI → визуальные задачи). Выходит новый релиз в другой линейке, явно лучше подходящей для ваш рабочей нагрузки. Или появляется специальное предложение для текущего уровня (Qwen Plus со скидкой 40%, акция Kimi flash).
Рабочие примеры
Пример 1: Ежедневный исследовательский cron (Hermes, 7 утра). Cron суммирует три новости об ИИ и публикует их в Discord. Цикл: воспроизводимый, пакетный, низкие ставки. По умолчанию: Уровень 2 (DeepSeek V4 Flash или Kimi K2.7). Эскалация только если в течение трех дней подряд в суммарных данных отсутствуют важные новости. Стоимость: $3–$8 в месяц.
Пример 2: Производственная функция (Claude Code). Многоарендный процесс выставления счетов с безопасностью на уровне строк. Цикл: интерактивное кодирование, тестово-проверено. По умолчанию: многоуровневая маршрутизация: Sonnet 4.5 для рутинных 80%, Opus 4.8 для сложных подзадач. Стоимость: $30–$80 в месяц.
Пример 3: Одноразовое креативное задание. Презентация (pitch deck) нужна завтра. Цикл: одноразовый, с высокими ставками. По умолчанию: Уровень 1, Opus 4.8 или Fable 5. Эта одна попытка требует лучшей модели, которую вы можете купить.
Пример 4: Агент с долгой перспективой (Hermes на базе Qwen Max). Исследовательский проект, который работает четыре часа ночью, читая 50 PDF-файлов. Цикл: долгое выполнение, проверка через вывод. По умолчанию: Уровень 2 + агентский каркас, Qwen 3.7 Max или MiniMax M3 в оболочке Hermes. Стоимость: 10–25 долларов в месяц.
Напишите ваше правило маршрутизации
Упражнение
Откройте текстовый файл на своем компьютере. Запишите ответ на это своими словами, без копирования и вставки:
«Выберите три AI-задачи, которые вы выполняли на этой неделе. Для каждой: укажите цикл (одиночный запуск / ежедневный Q&A / кодирование / долгосрочный / мультимодальный), укажите стандартный уровень (1 / 2 / несколько уровней), и укажите одну конкретную модель. Затем запишите триггер, который должен заставить вас сменить уровень.»
Хороший ответ охватывает три задачи, три уровня, три модели и три триггера.
Чтобы адаптировать эту структуру для своих задач, замените пять циклов в вопросе 1 на те пять, которые вы реально выполняете. Затем замените бюджеты в вопросе 2 на вашу реальную месячную трату.
Распечатайте результат и прикрепите его над монитором.
Что дальше
Hermes L06: Маршрутизация моделей и стоимость: маршрутизация с уровнями в реальной оболочке.
Hermes L09: Hermes против альтернатив: Claude Code против Hermes против Mavis.