Кейсовое исследование продукта · 31 августа 2026

Превью Tencent Hy4 — это модель с открытыми весами 770B и контекстным окном 1M, но без хостинг-маршрута.

Превью Tencent Hy4 имеет 770B общих параметров, 49B активных параметров, контекстное окно 1M и веса под лицензией Apache-2.0, но не имеет проверенного хостингового маршрута для инференса.

Время чтения
6 мин
Проверено
31 августа 2026
Восемь зеленовато-голубых вычислительных блоков, обслуживающих контекстное окно на 1 миллион токенов под маркой Hy4 preview
Открытые веса и контекстное окно в 1M не то же самое, что одобренный, доступный путь для реального рабочего процесса кодирования
Итог

Смотрите предварительный просмотр Hy4, но пока не направляйте частную работу и не объявляйте её победителем в кодировании. Публичная карта поддерживает серьёзный рецепт для самостоятельного хостинга; у этого проекта нет ни одобренного маршрута хостинга, ни оборудования с восьмью GPU для запуска фиксированного бенчмарка.

Tencent выпустила предварительный просмотр Hy4 28 августа 2026 года в качестве предварительной модели с открытым весом, предназначенной для работы в области программной инженерии, исследований и финансового анализа.[3] Карточка Tencent описывает модель Mixture-of-Experts с общим числом параметров 770 млрд, 49 млрд активируемых параметров на токен и окном контекста на 1 млн токенов; это спецификации производителя, а не независимые измерения производительности.[1]

Что фактически опубликовано

Точный базовый идентификатор tencent/Hy4-preview; версия с инструкциями, квантизированная в FP8, это tencent/Hy4-preview-FP8; и документированный локальный сервер OpenAI-совместимый Tencent использует указанное имя сервера hy4-preview.[1][2] Обе полученные карточки модели указывают лицензию Apache 2.0.[1][2]

Hugging Face классифицирует карточки для генерации текста. Полученная карточка не указывает входные/выходные модальности для изображений, аудио или видео, поэтому это список текстовых моделей, а не доказательство мультимодального API.[1] Описания производительности Tencent упоминают программную инженерию, офисную деятельность и анализ, разработку игр и научные исследования; рассматривайте это как позиционирование поставщика, а не как результат теста Mantis.[1]

Раздел о собственных известных ограничениях Tencent важнее, чем его график запуска, для решения о раннем развертывании: в нем говорится, что предварительная версия Hy4 может тратить больше времени, чем необходимо, на рассуждения над сложными задачами и может чрезмерно проверять свою работу.[1] Reuters независимо сообщило ту же дату выпуска, масштаб модели, предполагаемые категории работы и предупреждение компании о длительных рассуждениях и чрезмерной проверке.[3]

Доступ и оборудование: текущее ограничение

На проверке 31 августа Hugging Face не показывал ни одного размещенного провайдера инференса для обоих tencent/Hy4-preview или tencent/Hy4-preview-FP8.[1][2] Официальное руководство по быстрому старту вместо этого описывает самостоятельное хостинг через vLLM или SGLang. Его рецепт vLLM запускает tencent/Hy4-preview-FP8 с --tensor-parallel-size 8, а рецепт SGLang аналогично использует --tp-size 8; это проверенный рецепт обслуживания, а не утверждение о том, что каждая конфигурация с восемью GPU достаточна.[1][2]

У этого эталонного рабочего нет nvidia-smi бинарного файла и нет утвержденной платной инфраструктуры. Поэтому он не скачивал веса, не отправлял данные репозитория на непроверенную стороннюю точку доступа и не создавал эталонный балл. Пакет эталона Hy4 фиксирует фиксированные задания, правила принятия, проверку хоста и явно заблокированный результат.

Что показывают — и не показывают — стартовые показатели Tencent

Tencent представляет таблицы эталонных данных и внутреннее экспертное сравнение в карточке модели. Эти показатели утверждений компании в настройках Tencent; они являются полезными ориентирами, а не заменой тех же разрешений инструментов, бюджетов, тестов принятия и учета исправлений человеком, применяемых в рабочем процессе Mantis.[1]

Наш редакционный вывод, следовательно, нейтральный: не продвигайте предварительный просмотр Hy4 в качестве стандартного для кодирования, пока он не завершит как минимум две из трёх фиксированных публичных задач по кодированию/агентам по утверждённому маршруту и с той же средой, что и сравнительная база. Запуск принимается только если его тесты, специфичные для задачи, пройдены, git diff --check проходит, не изменяются нерелевантные файлы, и все запрошенные артефакты существуют. Публичный пакет выводит немеряемый результат 0/0, а не преобразует неопределённость доступа в ошибку или победу.

Если у вас есть утверждённая инфраструктура

  1. Используйте изолированный публичный или очищенный репозиторий; не загружайте закрытые исходные коды, учетные данные или данные клиентов в недавно обнаруженный маршрут.
  2. Начните с задокументированного рецепта FP8 от Tencent и зафиксируйте точное изображение, версию модели, количество/тип GPU, тензорный параллелизм, настройки контекста и предположения о стоимости.[1]
  3. Последовательно выполните три фиксированные задачи для hy4-preview и указанной базовой линии с идентичными инструментами, разрешениями, бюджетами токенов/времени и тестами на приемлемость.
  4. Зафиксируйте необработанные результаты, затраченное время, количество повторов, количество токенов, предположения о стоимости у провайдера или при самостоятельном хостинге, а также время на исправление человеком. Не выводите эти числа из карты поставщика.
  5. Давайте положительную рекомендацию только тогда, когда как минимум два из трех результатов Hy4 приняты; в противном случае публикуйте ошибки и оговорки.

Этот выпуск важен, потому что веса и рекомендации по использованию публичны в рамках Apache-2.0. Это пока не является доказательством того, что Hy4 является экономичным или надежным вариантом по умолчанию для реального рабочего процесса агента. Операционный вопрос остается открытым: может ли законный, одобренный маршрут выполнить вашу проверенную задачу лучше, чем его базовый вариант?

Источники

[1] https://huggingface.co/tencent/Hy4-preview — Предварительная модель Tencent Hy4, инструкция [2] https://huggingface.co/tencent/Hy4-preview-FP8 — Предварительная модель Tencent Hy4-FP8, инструкция [3] https://www.reuters.com/world/asia-pacific/chinas-tencent-releases-new-open-source-ai-model-coding-research-tasks-2026-08-28 — Отчет о запуске Reuters

Запустите это в работу

Разделяйте открытые веса и легкий доступ: загрузка по Apache-2.0 не превращает модель 770B в тест с низким порогом сложности на локальной машине.

Попробовать

Используйте фиксированный пакет для публичных задач в `benchmarks/hy4-preview/` только после того, как будет доступен одобренный маршрут и эквивалентная базовая модель.

Докажите, что это сработало

Зачитывайте запуск только тогда, когда все проверки задачи, чистой разницы, запрошенных артефактов и объема выполнены успешно.

Где это может оплатить

Для работы с клиентами оценивайте проверенный маршрут, время обзора и процент принятых результатов, а не рейтинг поставщика.

Держите в поле зрения

  • Карточка модели Tencent перечисляет Hy4 preview как 770B-total, 49B-active MoE с контекстным окном на 1 миллион токенов.
  • Tencent выпускает как `tencent/Hy4-preview`, так и `tencent/Hy4-preview-FP8` под лицензией Apache-2.0; задокументированный рецепт обслуживания FP8 использует тензорный параллелизм на восьми GPU.
  • На момент проверки Hugging Face указал генерацию текста, но ни одного размещенного провайдера инференса для любой карточки модели.
Изучите рабочий процесс: выбор между моделями frontier и open-weight