Amazon SageMaker HyperPod에서 모델... 노트

Amazon SageMaker HyperPod에서 모델 캐싱으로 추론 콜드 스타트 줄이기

Amazon SageMaker HyperPod가 이제 추론을 위한 모델 캐싱을 지원합니다. 이를 통해 모델 가중치와 컨테이너 이미지를 클러스터 노드에 미리 로드하여, 파드가 네트워크를 통해 다운로드하는 대신 로컬 NVMe 스토리지에서 읽을 수 있습니다. 모델 캐싱이 콜드 스타트를 수십 분에서 몇 초로 단축하는 방법, 작동 방식, 그리고 활성화 방법을 알아보세요.