VentureBeat на русском
Подписаться
Hy3 от Tencent под лицензией Apache конкурирует с GLM-5.2, будучи вдвое меньше — и выигрывает везде, кроме программирования.
Tencent выпустила полную версию своей модели Hy3, модели Mixture-of-Experts (MoE) с 295 миллиардами параметров, под разрешительной лицензией Apache 2.0, сняв предыдущие географические ограничения, которые препятствовали ее внедрению. Это изменение лицензии, являющееся значительным откатом от предварительной версии, было широко одобрено сообществом открытых моделей, причем некоторые предполагают, что оно позиционирует Tencent как лидера в области открытого исходного кода.Архитектура Hy3 остается неизменной по сравнению с предварительной версией апреля, имея в общей сложности 295 миллиардов параметров и 21 миллиард активных параметров на прямой проход. Tencent утверждает, что полная версия значительно превосходит модели аналогичного размера и конкурирует с флагманскими моделями с открытым исходным кодом, которые в два-пять раз больше. Модель была сформирована на основе отзывов более чем 50 внутренних продуктовых команд, что привело к улучшениям в выполнении задач и взаимодействии.Хотя слепое исследование Tencent на людях указывает на превосходство Hy3 над GLM-5.1 в определенных областях разработки, она отстает от GLM-5.2 в бенчмарках агентного кодирования. GLM-5.2, будучи более крупной моделью с примерно 744 миллиардами параметров, сохраняет свое лидерство в производительности кодирования. Однако Hy3 превосходит GLM-5.2 в агентном поиске, оркестровке инструментов и извлечении информации в контексте больших объемов данных, что делает ее сильным претендентом для рабочих нагрузок, связанных с поиском и инструментами.Ключевым аспектом выпуска Hy3 является акцент на метриках надежности и экономике развертывания, а не только на результатах бенчмарков. Tencent сообщает о значительном снижении уровня галлюцинаций и ошибок здравого смысла по сравнению с предварительной версией, объясняя эти улучшения тщательной очисткой данных и ограничениями обучения. Эти улучшения надежности решают критически важную проблему для корпоративных покупателей, ищущих модели, которые стабильно работают в производственных средах.С экономической точки зрения Hy3 предлагает более доступное решение для развертывания, чем GLM-5.2. С объемом FP8 менее 300 ГБ Hy3 требует меньше памяти и вычислительных ресурсов, снижая аппаратный барьер для самостоятельного размещения. Рекомендуемая Tencent конфигурация обслуживания нацелена на Nvidia H20-3e, GPU, разработанный с учетом экспортных ограничений США в отношении Китая, обеспечивая более широкий доступ. Эта обусловленная ограничениями конструкция делает модель эффективной на различных аппаратных средствах, в том числе доступных в западных центрах обработки данных.Сочетание разрешительной лицензии Apache 2.0, высокой производительности в конкретных агентных задачах, повышенной надежности и более доступной экономики развертывания позиционирует Hy3 как жизнеспособный вариант для предприятий. Он особенно привлекателен для организаций, которые отдают приоритет надежности и экономичной инфраструктуре над абсолютной производительностью кодирования. Оставшаяся неопределенность заключается в том, примут ли западные предприятия модель Tencent, учитывая ее китайское происхождение, и как будущие независимые бенчмарки повлияют на ее внедрение.