Cloud Native Computing Foundation 中文 关注 在峰值到来前进行扩展:Kubernetes 上 GPU 工作负载的预测式自动扩缩容 凌晨 3 点的呼叫 周二清晨,我们收到了告警。一项关键生产服务在流量下崩溃——并非逐渐降级,而是直接崩溃。数百个待处理的 Pod。用户遭遇了 15%–20% 的错误率。事后复盘报告如下…… Scale before the spike: Predictive autoscaling for GPU workloads on Kubernetes cncf.io Cloud Native Computing Foundation 中文 RSS thenote.app