텐센트의 Apache 라이선스 Hy3, GLM-5.2의... 노트

텐센트의 Apache 라이선스 Hy3, GLM-5.2의 절반 크기로 경쟁하며 코딩을 제외한 모든 분야에서 승리

Tencent는 2950억 개의 파라미터를 가진 Mixture-of-Experts(MoE) 모델인 Hy3의 전체 버전을 허용적인 Apache 2.0 라이선스로 출시했으며, 이전의 채택을 방해했던 지리적 제한을 제거했습니다. 미리보기 버전 출시와는 상당히 다른 이 라이선스 변경은 오픈 모델 커뮤니티로부터 널리 찬사를 받았으며, 일부에서는 이를 통해 Tencent가 오픈 소스의 리더로 자리매김했다고 평가하고 있습니다.Hy3의 아키텍처는 4월 미리보기 버전과 일관성을 유지하며, 총 2950억 개의 파라미터와 순방향 패스당 210억 개의 활성 파라미터를 특징으로 합니다. Tencent는 전체 버전이 비슷한 크기의 모델보다 월등히 뛰어나며, 2~5배 더 큰 플래그십 오픈 소스 모델과 경쟁한다고 주장합니다. 이 모델은 50개 이상의 내부 제품 팀의 피드백을 통해 형성되었으며, 작업 실행 및 상호 작용 개선으로 이어졌습니다.Tencent의 블라인드 인간 연구는 Hy3가 특정 개발 영역에서 GLM-5.1보다 우수함을 나타내지만, 에이전트 코딩 벤치마크에서는 GLM-5.2에 뒤처집니다. 약 7440억 개의 파라미터를 가진 더 큰 모델인 GLM-5.2는 코딩 성능에서 선두를 유지합니다. 그러나 Hy3는 에이전트 검색, 도구 오케스트레이션 및 장기 컨텍스트 검색에서 뛰어나 검색 및 도구 집약적인 에이전트 워크로드에 강력한 경쟁자가 됩니다.Hy3 출시의 핵심 초점은 단순히 벤치마크 점수뿐만 아니라 신뢰성 지표 및 배포 경제성에 대한 강조입니다. Tencent는 미묘한 데이터 정리 및 훈련 제약으로 인한 개선 덕분에 미리보기 버전과 비교하여 환각율 및 상식 오류율이 크게 감소했다고 보고합니다. 이러한 신뢰성 개선은 프로덕션 환경에서 일관되게 작동하는 모델을 찾는 기업 구매자에게 중요한 우려 사항을 해결합니다.경제적 관점에서 Hy3는 GLM-5.2보다 더 달성 가능한 배포 솔루션을 제공합니다. FP8 풋프린트가 300GB 미만이므로 Hy3는 더 적은 메모리와 컴퓨팅을 필요로 하여 자체 호스팅을 위한 하드웨어 장벽을 줄입니다. Tencent에서 권장하는 서빙 구성은 중국에 대한 미국 수출 제한에 맞춰 설계된 GPU인 Nvidia의 H20-3e를 대상으로 하여 접근성을 높입니다. 이러한 제약 기반 설계는 서구 데이터 센터에서 사용 가능한 것을 포함한 다양한 하드웨어에서 모델을 효율적으로 만듭니다.허용적인 Apache 2.0 라이선스, 특정 에이전트 작업에서의 강력한 성능, 향상된 신뢰성 및 더 접근 가능한 배포 경제성의 조합은 Hy3를 기업에게 실행 가능한 옵션으로 자리매김합니다. 특히 절대적인 코딩 성능보다 신뢰성과 비용 효율적인 인프라를 우선시하는 조직에게 매력적입니다. 중국 출신이라는 점을 감안할 때 서구 기업들이 Tencent 모델을 수용할지 여부와 향후 독립적인 벤치마크가 채택에 어떤 영향을 미칠지는 여전히 불확실합니다.
CdXz5zHNQW_bnIZRhdrZr.png