Gemma-4-31B-it-assistant 및 Gemma-4-31B-IT-NVFP4 모델이 Amazon SageMaker JumpStart에서 사용 가능합니다.
Google DeepMind의 Gemma-4-31B-it-assistant와 NVIDIA의 Gemma-4-31B-IT-NVFP4 모델이 Amazon SageMaker JumpStart를 통해 이제 접근 가능합니다. 이 모델들은 강력한 Gemma 4 31B dense 아키텍처를 엔터프라이즈 사용 사례에 제공합니다. 어시스턴트 튜닝된 Gemma-4-31B-it-assistant는 멀티모달 추론, 코딩, 에이전트 워크플로우에서 뛰어난 성능을 발휘합니다. 텍스트와 이미지 입력을 수용하며, 방대한 컨텍스트 창을 지원하고 140개 이상의 언어를 처리합니다. 이 변형 모델은 오픈 모델 리더보드에서 높은 순위를 차지하며 더 큰 모델들을 능가합니다. 하이브리드 어텐션 메커니즘과 자율 에이전트를 위한 네이티브 함수 호출을 활용합니다. NVIDIA의 Gemma-4-31B-IT-NVFP4는 동일한 기능을 제공하지만 메모리 사용량이 현저히 줄었습니다. NVIDIA의 ModelOpt를 사용하여 4비트 FP4 정밀도로 양자화되어 메모리 요구량이 적고 추론 속도가 빠릅니다. 이 최적화된 버전은 높은 품질을 유지하며 비용 효율적인 프로덕션 배포에 적합합니다. SageMaker JumpStart를 통해 사용자는 최소한의 클릭으로 이러한 모델을 쉽게 배포할 수 있습니다. 고객은 SageMaker 콘솔 또는 SageMaker Python SDK를 통해 이러한 모델에 접근할 수 있습니다.