이번 달 AI 인프라 및 오케스트레이션의 새로운 소식 노트

이번 달 AI 인프라 및 오케스트레이션의 새로운 소식

Google은 에이전트 시대를 지원하기 위해 AI 인프라에 대한 포괄적인 발전을 이루고 있습니다. Gemini와 같은 선도적인 AI 모델을 개발하고 소프트웨어 프레임워크 및 하드웨어를 설계합니다. Google은 또한 AI를 일상적인 도구에 통합하고 컴퓨팅, 가속기 및 오케스트레이션 소프트웨어를 포함한 기본 인프라를 구축합니다. 이 강력한 인프라는 더 빠르게 혁신하고 더 나은 사용자 경험을 제공하려는 기업에 매우 중요합니다. Google은 제품, 기술 및 도구 업데이트를 포함하여 AI 인프라 뉴스에 대한 월별 업데이트를 제공합니다. 최근 업데이트에서는 Google Cloud Managed Lustre, C4N 네트워크 최적화 VM 및 GKE Dataplane V2 확장이 강조되었습니다. 새로운 기능에는 RL 워크로드를 위한 협력적 시간 분할 및 오픈 소스 k8s-aibom 보안 도구가 포함됩니다. 실무자 가이드에서는 Kimi K3와 같은 모델 배포 및 TPU에서 다양한 AI 워크로드 실행에 대한 자세한 지침을 제공합니다. 기술 청사진은 Google의 TPU에서 대규모 모델의 성능 최적화를 보여줍니다. Google은 Gartner로부터 AI 인프라 분야의 리더로 인정받았습니다. 보고서에 따르면 AI 야망과 인프라 현실 간의 격차가 벌어지고 있으며 대부분의 조직에서 업그레이드가 필요한 것으로 나타났습니다. 안전한 AI 데이터 처리를 위해 가속기 최적화 G4 머신 시리즈에서 Confidential Computing을 사용할 수 있습니다. TPU 개발자 허브 및 TPU AI 원격 측정 수집기 에이전트는 개발자를 위한 새로운 리소스를 제공합니다. GKE에서 AI 추론 워크로드에 고가용성을 구축하고 Cloud Storage의 데이터에 AI 에이전트를 연결하는 것은 새로운 가이드에서 자세히 설명됩니다. 독립적인 벤치마크에 따르면 GKE 추론 게이트웨이는 선도적인 관리형 Kubernetes 서비스보다 뛰어난 성능을 보입니다. 고객 성공 사례는 의료 및 고객 리뷰 플랫폼에서 Google AI 인프라의 성공적인 적용을 보여줍니다.