Обзор GLM 5.3 (не используйте субагентов на ZCode)

Опубликовано
17 августа 2026 г.
Продолжительность
19:45
Нажмите, чтобы загрузить плеер YouTube

Мы опробовали GLM 5.3 на ZCode и создали с его помощью 16 проектов. Самая модель сильная, но настройка субагентов в ZCode нас разочаровала. Вот что мы обнаружили и как правильно использовать GLM 5.3.

Модель намного лучше

GLM 5.3 использует ту же базовую модель, что и GLM 5.2, но получила улучшение кода на 50% по сравнению с обучением. Это настоящий скачок. В Terminal Bench 3.0 она немного отстаёт от Fable 5 и GPT-5.6, опережая Kimi K3. В тестах автоматизации она даже опережает Kimi K3. Z.AI также говорит, что она на передовой стадии CyberJim в области обнаружения уязвимостей, что важно для работы с безопасностью.

Значит, возможность кодирования есть. Проблема в том, как мы её использовали. Мы запускали каждый проект через субагентов, чтобы сэкономить токены и время, но в документации ZCode указано, что память проекта применяется к основному агенту, а не к субагентам. Мы сжили 40% нашего недельного лимита на план лёгкого кодирования за один день. Субагенты создали весь код, но результаты были разочаровывающими.

Субагенты на ZCode слабы

Мы запустили тот же 16-проектный визуальный бенчмарк, который используем для других моделей. С субагентами результаты были хаотичными. Веб-сайт с прокруткой города был несвязным, потому что мы не дали ему никаких ссылок. GLM 5.2 справился отлично, когда мы предоставили ему спецификации и интерфейс сайта Astro, но на этот раз это был стопроцентный фристайл. Прокрутка была плавной, но не было направления.

Некоторые игры работали, но казались странными. Ember Glider имела странное дрожание, когда промахиваешься через кольцо, и управление было тяжёлым. У Jabberwock была странная камера: при нажатии S вы двигались вперёд. В игре tower defense нельзя было разместить турели на площадках. Neon Drift и Universe Simulator были просто черными экранами. Стройка древней китайской архитектуры выглядела неправильно и парила в воздухе.

Некоторые вещи выделялись как достойные. Симулятор механических часов имел хорошие детали освещения. Вайс-Сити выглядело иначе, чем другие модели, больше похоже на старую игру для Нокиа, чем на обычный неоновый стиль. Симулятор офисной жизни имел рабочую навигацию для стульев. Но это были исключения.

Тест в чашке Петри был интересным. Хищники иногда умирали, в то время как добыча выживала, так что GLM 5.3, похоже, склонен поддерживать андердогов. Это не ошибка, просто предвзятость в том, как он мыслит.

Используйте главного агента, а не субагентов

Если вы используете GLM 5.3 на ZCode, дайте ему указание кодировать проект самостоятельно. Не позволяйте ему координироваться с субагентами. Система ZCode не предназначена для эффективной работы субагентов. Claude Code, вероятно, работает с субагентами намного лучше, потому что система разработана для этого. Мы планируем снова протестировать GLM 5.3, когда основной агент будет делать всё сам, проект за проектом. Это займёт больше времени, но должно показать, на что модель действительно способна.

GLM 5.3 не имеет возможностей работы с изображениями, поэтому для визуальных задач нужны инструкции и ссылки. Он работает только с текстом, а наши тесты выполняли рендеринг графики локально на GPU. Это значит, что вы должны быть конкретны в том, что хотите.

Подсказки для всех 16 проектов находятся на нашем сайте, mantis.guru, если хотите попробовать сами. Кратко: GLM 5.3 хорошо справляется с кодированием, а субагенты ZCode — нет. Создавайте с помощью основной модели и настраивайте свои собственные циклы.