Amazon SageMaker AI가 이제 학습 및 처리 작업에 대한 인스턴스 우선순위 목록을 지원합니다.
오늘 Amazon SageMaker AI는 학습 및 처리 작업에 대한 인스턴스 우선순위 목록을 발표하여 워크로드에 대한 컴퓨팅 용량을 더 쉽고 빠르게 찾을 수 있도록 합니다. 많은 AI 학습, 미세 조정 및 데이터 처리 워크로드는 여러 인스턴스 유형 또는 크기 중 어느 것이든 비교적 잘 실행됩니다. 그러나 이전에는 작업 제출 시 하나의 인스턴스 유형만 지정하고 SageMaker가 해당 특정 인스턴스를 작업에 찾을 때까지 기다려야 했습니다. 피크 기간 동안 수요가 많은 GPU의 경우 대기 시간이 예측 불가능할 수 있으므로 고객은 복잡한 재시도 로직을 구축하거나 사용 가능한 첫 번째 옵션을 찾기 위해 다른 인스턴스 유형으로 여러 작업을 동시에 제출해야 하는 경우가 있었습니다. 이제 작업에서 허용하는 인스턴스 유형의 우선순위 목록을 제공하기만 하면 SageMaker가 우선순위에서 첫 번째로 사용 가능한 구성에서 자동으로 작업을 실행합니다. 이 솔루션을 사용하면 학습 또는 처리 작업이 더 빨리 시작될 가능성이 높습니다.이 기능을 사용하려면 학습 또는 처리 작업을 제출할 때 인스턴스 유형 및 개수 우선순위를 우선순위 순서대로 지정합니다. 예를 들어 목록에는 ml.g6.48xlarge 인스턴스 두 개 또는 ml.g5.48xlarge 인스턴스 네 개에 대한 우선순위가 포함될 수 있습니다. SageMaker는 목록을 검토하고 용량을 사용할 수 있는 첫 번째 구성에서 작업을 시작합니다. 또한 동일한 작업 제출 내에서 온디맨드 소스 또는 예약된 SageMaker Flexible Training Plans에서 용량 소싱을 구성할 수도 있습니다. 이 기능은 수요가 많은 기간 동안 작업에 대한 컴퓨팅을 확보하는 프로세스를 단순화하고, 그렇지 않으면 수행해야 할 차별화되지 않은 수동 재시도를 줄이며, 모두 이미 사용 중인 SageMaker 학습 및 처리 작업 API 내에서 이루어집니다.SageMaker 학습 및 처리 작업에 대한 인스턴스 우선순위 목록은 오늘날 SageMaker CLIs, API, SDK 및 콘솔 UI를 통해 SageMaker를 사용할 수 있는 모든 AWS 리전에서 사용할 수 있습니다. 자세한 내용은 설명서 또는 출시 블로그를 참조하십시오.