Midjourney и другие нейросети - страница 1238

 

Tencent представила открытую модель Hy4 Preview: 770 млрд параметров, 1M контекст и топ-5 в Code Arena


//текст и обложка Gemini 3.6 Flash. https://www.tencent.com/tencent-releases-and-open-sources-tencent-hy4-preview/

Китайский технологический гигант Tencent официально анонсировал и выложил в открытый доступ флагманскую языковую модель нового поколения — Hy4 Preview. Это модель на базе архитектуры Mixture-of-Experts (MoE), созданная для автоматизации веб-разработки, работы со сложным кодом, вызова инструментов в автономных агентах и анализа сверхдлинных документов.

Архитектура и ключевые характеристики

Hy4 Preview демонстрирует один из самых мощных приростов производительности и эффективности инференса в линейке Tencent:

  • Масштаб и параметры: Общий объем модели составляет 770 млрд параметров, из которых при генерации каждого токена активируется 49 млрд (78 слоев, 256 маршрутизируемых экспертов + 1 общий).

  • Контекстное окно: Поддерживает работу с контекстом до 1 млн токенов.

  • Спекулятивное декодирование: В модель встроен нативный модуль MTP (Multi-Token Prediction) на 10 млрд параметров (0,7B активных), существенно ускоряющий генерацию.

  • Лицензия: Модель полностью открыта под лицензией Apache 2.0 и доступна для скачивания на Hugging Face.

  • Стоимость API: Tencent предложила крайне доступные тарифы на инференс — $0,83 за 1 млн входных и $2,50 за 1 млн выходных токенов (кэшированный ввод — $0,042).

Результаты в рейтинге Code Arena | WebDev

Согласно актуальным данным независимого рейтинга Code Arena (раздел WebDev / Front-end & Agentic Coding), модель зафиксировала результат в 1633 Elo (+17/-17) в режиме AutoEval (автоматический бенчмаркинг на комплексных задачах программирования).

По своим показателям открытая модель Hy4 Preview уверенно входит в топ-5 общего зачета и обгоняет ряд крупных закрытых проприетарных систем:

  • grok-4.6-high (1629 Elo, стоимость API $2 / $6);

  • claude-fable-5 (1626 Elo, стоимость API $10 / $50);

  • gpt-5.6-sol-xhigh (1619 Elo, стоимость API $4 / $20).

В категории решений с открытым кодом Hy4 Preview идёт практически вплотную с glm-5.3-flash (1634 Elo), уступая только коммерческим лидерам таблицы — claude-opus-5-max (1691 Elo), kimi-k3-max (1674 Elo) и qwen3.8-max (1669 Elo).

https://arena.ai/leaderboard/code


Бенчмарки и слепое тестирование

На специализированных наборах тестов модель показывает высокие результаты в агентурных задачах и написании кода:

  • Terminal-Bench 2.1: 85,4 балла — один из наивысших показателей среди открытых моделей;

  • Toolathlon-Verified: 74,1 балла — высокая точность в сценариях с вызовом внешних API и инструментов;

  • DeepSWE: 64,3 балла (огромный скачок по сравнению с 28,0 у прошлых версий);

  • APEX-Agents: 37,1 балла.

Помимо синтетических тестов, Tencent провела внутренний слепой эксперимент: 163 инженера оценили работу моделей на 203 реальных задачах программирования по 4-балльной шкале:

  • Hy4 Preview: 2,99 / 4,00

  • Kimi K3: 2,94 / 4,00

  • GLM-5.3: 2,92 / 4,00

В прямых дуэлях против Kimi K3 модель Hy4 Preview одержала победу в 51,2% случаев, показала равный результат в 7,9% и уступила в 40,9% задач.


Самосовершенствование и оптимизация

  • Рекурсивное самосовершенствование (Self-Improvement Loop): Tencent задействовала предрелизные сборки Hy4 Preview для оптимизации процесса ее собственного обучения. Модель предлагала гипотезы по обработке данных, настраивала операторы и оценивала результаты экспериментов.

  • Оптимизация инференса: Модель самостоятельно проанализировала узкие места собственной инфраструктуры, проведя оптимизацию связи и слияния операторов, что подняло пропускную способность (throughput) на 31,8%.

Итоги и доступность

Tencent Hy4 Preview задает новый стандарт для open-source сегмента: модель сочетает открытую коммерческую лицензию Apache 2.0, контекстное окно в 1M токенов, низкую стоимость API и производительность на уровне лучших закрытых проприетарных флагманов.

Превью-версия на данный момент остается сугубо текстовой (поддержка изображений и видео ожидается в полноценном релизе). Модель уже интегрирована в среды разработки CodeBuddy и WorkBuddy, сервисы Yuanbao и ima, а также доступна через Tencent Cloud TokenHub и OpenRouter.

 

На данный момент GLM 5.3 Flash является наиболее коммерчески выгодной ИИ-моделью среди конкурентов по api.

Похоже, что у DeepSeek 4 Flash есть достойный ценовой конкурент.

Но если брать подписки, то они везде +-20$/месяц