Tencent выпустила в открытый доступ свою новую большую языковую модель Hy4 Preview. Модель, ориентированная на программирование, офисные приложения и научные исследования, насчитывает 770 миллиардов параметров; благодаря подходу Mixture-of-Experts на один запрос активируются 49 миллиардов параметров. Контекстное окно превышает 1 миллион токенов.
В слепом тестировании, проведённом Tencent с участием 163 экспертов и по 203 инженерным задачам, Hy4 Preview получила 2,99 балла из 4; Kimi K3 набрала 2,94, а GLM-5.3 — 2,92 балла. Компания отметила, что результаты основаны на её внутренней оценке.
Модель может использоваться для разработки программного обеспечения с длинным контекстом, анализа данных и финансового анализа, создания документов, электронных таблиц и презентаций, разработки игровых прототипов и решения научных задач. Tencent также заявила, что Hy4 Preview внесла вклад в оптимизацию обучения, данных, оценки и операторов, а также за счёт устранения узких мест в собственной инфраструктуре увеличила сквозную производительность на 31,8%.
Модель доступна через WorkBuddy, CodeBuddy, Yuanbao, ima, Tencent Cloud TokenHub, OpenRouter и Hugging Face. Стоимость API установлена на уровне 0,834 доллара за 1 миллион входных токенов, 2,501 доллара за 1 миллион выходных токенов и 0,042 доллара за 1 миллион токенов, использованных из кэша.
Почему это важно
Открытая публикация Hy4 Preview превращает модель из сервиса, ограниченного только собственными продуктами Tencent, в вариант, который разработчики и исследователи могут изучать в различных сценариях использования. Контекстное окно объёмом более одного миллиона токенов позволяет модели за один раз обрабатывать больший объём информации, что особенно важно для команд, работающих над крупными программными проектами, с обширной документацией и большими наборами данных. Доступ через WorkBuddy, CodeBuddy, Tencent Cloud TokenHub, OpenRouter и Hugging Face, а также объявление цен на API позволяют оценивать решение об использовании не только с точки зрения технических характеристик, но и с учётом стоимости. Вместе с тем, поскольку заявление о превосходстве в производительности основано на собственном внутреннем слепом тестировании Tencent, остаётся открытым вопрос о том, будет ли получен такой же результат в других и независимых оценках.