Кейсовое исследование продукта · 31 августа 2026

Agnes 2.5 Pro Alpha вновь появилась в августе, но её выпуск состоялся 24 июля

Agnes 2.5 Pro Alpha имеет веса Apache-2.0, платный API совместимый с OpenAI и заявленный контекст на 1 млн токенов. Его API-бенчмарк Mantis остаётся не измеренным.

Время чтения
6 мин
Проверено
31 августа 2026
Карточка предварительной проверки Agnes API с весами Apache-2.0, контекстом из одного миллиона токенов, платным маршрутом и неизмеренным результатом
Документированное API и модельная карточка не являются независимыми показателями производительности рабочего процесса
Итог

Следите за Agnes 2.5 Pro Alpha, а не воспринимайте обновленные данные лидерборда как новое запуск или оценку Mantis. Ее веса, платный API маршрут, ценовая карточка и утверждение о большом контексте задокументированы, но этот работник не получил учетных данных API или разрешения на расходы для фиксированного общественного теста.

Agnes 2.5 Pro Alpha появляется в обзорах моделей, но это не новый августовский релиз.[3] Собственная документация API Agnes указывает дату выпуска как 24 июля 2026 года.[3] Обновленная позиция в лидерборде не обнуляет время доказательств и не делает оценку поставщика независимым результатом рабочего процесса.[не проверено]

Что проверяют публичные материалы

Точный репозиторий публичных весов находится по адресу Agnes-AI/Agnes-2.5-Pro-Alpha; его карточка идентифицирует мультимодальную модель рассуждений с контекстным окном на 1 048 576 токенов, максимальным выходом 65 536 токенов, текстовым и визуальным вводом, текстовым выводом, вызовом инструментов и потоковой передачей.[1] Репозиторий включает текст лицензии Apache 2.0 с уведомлениями о правах авторов Agnes AI и Alibaba Cloud/Qwen.[2]

Отдельный платный API использует ту же строку модели agnes-2.5-pro-alpha в https://apihub.agnes-ai.com/v1.[3] Документированные конечные точки Chat Completions, Responses и Messages совместимы с интеграцией OpenAI.[3] Таблица цен указывает $0.45 за миллион входных токенов, $0.045 за кэшированные входные токены и $0.90 за выход.[3] Это задокументированные цены, а не измеренная стоимость принятого результата.[не подтверждено]

Для локального использования карта SGLang быстро начинает работу с тензорным параллелизмом восьми и рекомендует восемь графических процессоров NVIDIA H200 (141 ГБ) или эквивалент, плюс около 1 ТБ быстрой NVMe.[1] Это рецепт работы от производителя, а не независимо проверенный минимум или заявление о стоимости развертывания в производстве.[непроверено]

Несоответствие метаданных, которое стоит держать на виду

В опубликованных материалах существует реальный конфликт происхождения.[1][3] Карта модели, автор репозитория, руководство по API и лицензия указывают на Agnes AI.[1][2][3] Опубликованная chat_template.jinja, однако, вводит системную идентичность, утверждающую, что модель разработана «Sapiens AI».[1] Мы не разрешаем этот конфликт путем вывода.[непроверено] Рассматривайте это как нерешенное замечание по идентичности/метаданным оценщика до тех пор, пока издатель не предоставит ясное объяснение.[непроверено]

Карта также воспроизводит таблицы оценки Искусственного анализа и называет их независимыми измерениями, в то время как текущее руководство по API говорит, что метаданные сторонних источников могут сохранять старые записи.[1][3] Эти данные могут быть полезными внешними сигналами, но они не являются фиксированной системой этого сайта и не доказывают поведение, задержку, цену или надежность инструмента живого API.[непроверено]

Почему пока нет оценки Mantis

Пакет бенчмарка по адресу benchmarks/agnes-2-5-pro-alpha/ закрепляет три публичные семьи задач Mantis и повторяет каждую три раза.[непроверено] Каждое принятое выполнение должно пройти тест задачи, git diff --checkправила объема вывода, проверку человеком по рубрике подсказки и полный отредактированный отчет по метрикам.[непроверено] Положительная рекомендация по покрытию требует как минимум двух принятых семей задач и семи принятых выполнений из девяти.[непроверено]

У рабочего не было AGNES_API_KEY; неаутентифицированный /v1/models запрос вернул HTTP 401, и авторизация на расход не была предоставлена.[непроверено] Отправка синтетического запроса без авторизованного аккаунта все равно создала бы платный запрос, поэтому запуск не был выполнен.[3] Результат не выполнен, а не нулевое качество.[непроверено] Не заявляется никаких данных о задержке, использовании, стоимости принятого результата или независимом сравнении скорости.[непроверено]

Решение о покупке

Agnes 2.5 Pro Alpha является правдоподобным кандидатом для команд, которым конкретно нужна её задокументированная совместимая с OpenAI API, длинный контекст, текстовые/изображенческие входные данные и веса Apache-2.0.[1][2][3] Она пока не является кодировочной настройкой по умолчанию, рекомендованной Mantis.[непроверено] Сначала получите одобренный доступ к аккаунту и ограниченный бюджет, выполните фиксированный публичный пакет через явно указанный маршрут сравнения, и сохраните как ошибки, так и принятые результаты.[непроверено] До этого времени наблюдайте за ней как за июльским выпуском с задокументированными возможностями и неразрешённой метаданной — не как за победителем августовского запуска.[непроверено]

Источники

[1] https://huggingface.co/Agnes-AI/Agnes-2.5-Pro-Alpha — Карточка модели Agnes 2.5 Pro Alpha [2] https://huggingface.co/Agnes-AI/Agnes-2.5-Pro-Alpha/raw/main/LICENSE — Лицензия Apache 2.0 для Agnes 2.5 Pro Alpha [3] https://wiki.agnes-ai.com/en/docs/agnes-25-pro-alpha — Документация API Agnes 2.5 Pro Alpha

Запустите это в работу

Сохраняйте спецификацию модели, рейтинг поставщиков и результаты согласованного рабочего процесса как отдельные классы доказательств.

Попробовать

Используйте пакет для публичных задач только с одобренной учетной записью, явным лимитом расходов и синтетическими/публичными входными данными.

Докажите, что это сработало

Записывайте маршрут, использование ответов, затраченное время, попытки, принятие артефактов, проверки объема и время исправления для каждого запуска.

Где это может оплатить

Сравнивайте стоимость за принятый результат, а не строку цены в спецификации модели или скриншот рейтинга.

Держите в поле зрения

  • Агнес документирует точный ID модели API как `agnes-2.5-pro-alpha` и её веса как `Agnes-AI/Agnes-2.5-Pro-Alpha`.
  • Официальный документ API называет её платной и указывает $0.45 за входные данные, $0.045 за кэшированные входные данные и $0.90 за вывод на 1 млн токенов.
  • Дата выхода — 24 июля 2026 года, а не запуск новой модели в августе, и у Mantis пока нет официально измеренного результата.
Изучите рабочий процесс: как выбирать модель по задаче