Кейсовое исследование продукта · 31 августа 2026
Превью Tencent Hy4 — это модель с открытыми весами 770B и контекстным окном 1M, но без хостинг-маршрута.
Превью Tencent Hy4 имеет 770B общих параметров, 49B активных параметров, контекстное окно 1M и веса под лицензией Apache-2.0, но не имеет проверенного хостингового маршрута для инференса.
Смотрите предварительный просмотр Hy4, но пока не направляйте частную работу и не объявляйте её победителем в кодировании. Публичная карта поддерживает серьёзный рецепт для самостоятельного хостинга; у этого проекта нет ни одобренного маршрута хостинга, ни оборудования с восьмью GPU для запуска фиксированного бенчмарка.
Tencent выпустила предварительный просмотр Hy4 28 августа 2026 года в качестве предварительной модели с открытым весом, предназначенной для работы в области программной инженерии, исследований и финансового анализа.[3] Карточка Tencent описывает модель Mixture-of-Experts с общим числом параметров 770 млрд, 49 млрд активируемых параметров на токен и окном контекста на 1 млн токенов; это спецификации производителя, а не независимые измерения производительности.[1]
Что фактически опубликовано
Точный базовый идентификатор tencent/Hy4-preview; версия с инструкциями, квантизированная в FP8, это tencent/Hy4-preview-FP8; и документированный локальный сервер OpenAI-совместимый Tencent использует указанное имя сервера hy4-preview.[1][2] Обе полученные карточки модели указывают лицензию Apache 2.0.[1][2]
Hugging Face классифицирует карточки для генерации текста. Полученная карточка не указывает входные/выходные модальности для изображений, аудио или видео, поэтому это список текстовых моделей, а не доказательство мультимодального API.[1] Описания производительности Tencent упоминают программную инженерию, офисную деятельность и анализ, разработку игр и научные исследования; рассматривайте это как позиционирование поставщика, а не как результат теста Mantis.[1]
Раздел о собственных известных ограничениях Tencent важнее, чем его график запуска, для решения о раннем развертывании: в нем говорится, что предварительная версия Hy4 может тратить больше времени, чем необходимо, на рассуждения над сложными задачами и может чрезмерно проверять свою работу.[1] Reuters независимо сообщило ту же дату выпуска, масштаб модели, предполагаемые категории работы и предупреждение компании о длительных рассуждениях и чрезмерной проверке.[3]
Доступ и оборудование: текущее ограничение
На проверке 31 августа Hugging Face не показывал ни одного размещенного провайдера инференса для обоих tencent/Hy4-preview или tencent/Hy4-preview-FP8.[1][2] Официальное руководство по быстрому старту вместо этого описывает самостоятельное хостинг через vLLM или SGLang. Его рецепт vLLM запускает tencent/Hy4-preview-FP8 с --tensor-parallel-size 8, а рецепт SGLang аналогично использует --tp-size 8; это проверенный рецепт обслуживания, а не утверждение о том, что каждая конфигурация с восемью GPU достаточна.[1][2]
У этого эталонного рабочего нет nvidia-smi бинарного файла и нет утвержденной платной инфраструктуры. Поэтому он не скачивал веса, не отправлял данные репозитория на непроверенную стороннюю точку доступа и не создавал эталонный балл. Пакет эталона Hy4 фиксирует фиксированные задания, правила принятия, проверку хоста и явно заблокированный результат.
Что показывают — и не показывают — стартовые показатели Tencent
Tencent представляет таблицы эталонных данных и внутреннее экспертное сравнение в карточке модели. Эти показатели утверждений компании в настройках Tencent; они являются полезными ориентирами, а не заменой тех же разрешений инструментов, бюджетов, тестов принятия и учета исправлений человеком, применяемых в рабочем процессе Mantis.[1]
Наш редакционный вывод, следовательно, нейтральный: не продвигайте предварительный просмотр Hy4 в качестве стандартного для кодирования, пока он не завершит как минимум две из трёх фиксированных публичных задач по кодированию/агентам по утверждённому маршруту и с той же средой, что и сравнительная база. Запуск принимается только если его тесты, специфичные для задачи, пройдены, git diff --check проходит, не изменяются нерелевантные файлы, и все запрошенные артефакты существуют. Публичный пакет выводит немеряемый результат 0/0, а не преобразует неопределённость доступа в ошибку или победу.
Если у вас есть утверждённая инфраструктура
- Используйте изолированный публичный или очищенный репозиторий; не загружайте закрытые исходные коды, учетные данные или данные клиентов в недавно обнаруженный маршрут.
- Начните с задокументированного рецепта FP8 от Tencent и зафиксируйте точное изображение, версию модели, количество/тип GPU, тензорный параллелизм, настройки контекста и предположения о стоимости.[1]
- Последовательно выполните три фиксированные задачи для
hy4-previewи указанной базовой линии с идентичными инструментами, разрешениями, бюджетами токенов/времени и тестами на приемлемость. - Зафиксируйте необработанные результаты, затраченное время, количество повторов, количество токенов, предположения о стоимости у провайдера или при самостоятельном хостинге, а также время на исправление человеком. Не выводите эти числа из карты поставщика.
- Давайте положительную рекомендацию только тогда, когда как минимум два из трех результатов Hy4 приняты; в противном случае публикуйте ошибки и оговорки.
Этот выпуск важен, потому что веса и рекомендации по использованию публичны в рамках Apache-2.0. Это пока не является доказательством того, что Hy4 является экономичным или надежным вариантом по умолчанию для реального рабочего процесса агента. Операционный вопрос остается открытым: может ли законный, одобренный маршрут выполнить вашу проверенную задачу лучше, чем его базовый вариант?
Источники
[1] https://huggingface.co/tencent/Hy4-preview — Предварительная модель Tencent Hy4, инструкция [2] https://huggingface.co/tencent/Hy4-preview-FP8 — Предварительная модель Tencent Hy4-FP8, инструкция [3] https://www.reuters.com/world/asia-pacific/chinas-tencent-releases-new-open-source-ai-model-coding-research-tasks-2026-08-28 — Отчет о запуске Reuters
Запустите это в работу
Разделяйте открытые веса и легкий доступ: загрузка по Apache-2.0 не превращает модель 770B в тест с низким порогом сложности на локальной машине.
Попробовать
Используйте фиксированный пакет для публичных задач в `benchmarks/hy4-preview/` только после того, как будет доступен одобренный маршрут и эквивалентная базовая модель.
Докажите, что это сработало
Зачитывайте запуск только тогда, когда все проверки задачи, чистой разницы, запрошенных артефактов и объема выполнены успешно.
Где это может оплатить
Для работы с клиентами оценивайте проверенный маршрут, время обзора и процент принятых результатов, а не рейтинг поставщика.
Держите в поле зрения
- Карточка модели Tencent перечисляет Hy4 preview как 770B-total, 49B-active MoE с контекстным окном на 1 миллион токенов.
- Tencent выпускает как `tencent/Hy4-preview`, так и `tencent/Hy4-preview-FP8` под лицензией Apache-2.0; задокументированный рецепт обслуживания FP8 использует тензорный параллелизм на восьми GPU.
- На момент проверки Hugging Face указал генерацию текста, но ни одного размещенного провайдера инференса для любой карточки модели.