Cloud Native Computing Foundation 日本語 フォロー スパイク前のスケーリング:KubernetesにおけるGPUワークロードのための予測的オートスケーリング 火曜日の朝、私たちはページングを受けました。トラフィックの下でクリティカルな本番サービスがクラッシュしました。徐々に劣化するのではなく、クラッシュしたのです。保留中のポッドは数百個。ユーザーは15〜20%のエラー率を見ていました。インシデントのポストモーテムは… Scale before the spike: Predictive autoscaling for GPU workloads on Kubernetes cncf.io Cloud Native Computing Foundation 日本語 RSS thenote.app