Amazon EKS 与 EKS Distro 已支持 Kubernetes 1.37。AWS 在 2026 年 10 月 2 日的 What’s New 宣布,控制台、eksctl 与 IaC 均可新建或升级到 1.37。官方版本日历把 EKS 上线日记为 2026 年 10 月 1 日。上游 1.37 早在 8 月 26 日发版,本稿只盯托管侧落地与运维要点。
这次托管侧点名了什么
AWS 公告把三类变化写进了产品说明;上游全量发版笔记覆盖面更广,本稿只跟托管侧点名的部分。
Metrics API 进 GA。 metrics.k8s.io/v1
正式可用,向 HPA 与 kubectl top 提供 Pod、节点的 CPU
与内存用量。上游侧这条 API 在 Beta 待了近九年,1.37 才进 Stable;EKS
跟进后,新集群可以直接按稳定版路径规划指标依赖。
DRA 设备污点与容忍进 GA。 Dynamic Resource Allocation 的 device taints / tolerations 升到一般可用。DRA 驱动或管理员可以给 GPU 等设备打污点,调度器默认避开,只有带对应容忍的工作负载才会落到这些设备上。这对共享加速器池、隔离故障卡有直接用处。EKS 文档写明:在 EKS 上用 DRA 需要自行安装 DRA 驱动(平台不预装);NVIDIA DRA 驱动支持 Karpenter 静态容量、托管节点组与自管节点,不支持 EKS Auto Mode(Auto Mode 或 Karpenter 动态容量请用 NVIDIA device plugin)。
HPA 缩到零进 Beta,且默认开启。 使用 object 或
external metrics 时,可以把 spec.minReplicas 设为
0。空闲时缩到零
Pod,需求回来再拉起。CPU、内存指标本身依赖存活
Pod,不能用来驱动缩到零。上游在 1.37
发版说明 里补充:缩到零期间 HPA 状态会记
ScaledToZero=True,用来区分「控制器主动缩零」与「人手把副本写成
0」。
示意(按官方语义整理,未在本地 EKS 集群验证):
apiVersion: autoscaling/v2
kind: HorizontalPodAutoscaler
metadata:
name: queue-consumer
spec:
scaleTargetRef:
apiVersion: apps/v1
kind: Deployment
name: queue-consumer
minReplicas: 0
maxReplicas: 20
metrics:
- type: External
external:
metric:
name: queue_depth
target:
type: AverageValue
averageValue: "5"
适合队列消费者、批任务、按需 GPU 任务这类「没事就别占节点」的场景。上线前先确认指标源、冷启动时延与下游超时是否扛得住从零拉起。
升级路径与支撑日历
升级入口与往常一致:EKS 控制台、eksctl,或 CloudFormation / Terraform 一类 IaC。AWS 建议用 EKS cluster insights 先扫升级阻塞项,再动控制面。节点组、Fargate Pod、插件不会跟着控制面自动齐步;控制面升完仍要自己滚动节点与 addon。
按官方版本表(UTC+0):
| Kubernetes | 上游发版 | EKS 上线 | 标准支持结束 | 扩展支持结束 |
|---|---|---|---|---|
| 1.37 | 2026-08-26 | 2026-10-01 | 2027-12-01 | 2028-12-01 |
| 1.36 | 2026-04-22 | 2026-06-02 | 2027-08-02 | 2028-08-02 |
标准支持约 14 个月,之后进入按集群小时计费的扩展支持约 12 个月。1.37
现已列入标准支持;扩展支持档当前可见的是
1.33、1.32、1.31。就地升级完成后 7
天内可回滚到上一小版本;扩展支持档回滚要先把升级策略改成
EXTENDED。扩展支持到期后自动升级的集群不可回滚。
扩展支持会按集群小时加价,标准支持结束后的计费日从 UTC+0 当天开始。不想进扩展支持,需要在标准支持结束前升到仍处标准支持的版本,或按文档关掉扩展支持(关掉后到期会自动升)。新集群也可以直接建在扩展支持版本上,但长期停在旧小版本会叠费用与补丁风险。
EKS Distro 的 1.37 构建可在 ECR Public Gallery 与 GitHub 取用,适合自建控制面但仍想对齐 EKS 发行物的团队。公告写明:凡 EKS 可用的区域(含 AWS GovCloud (US))均可跑 1.37。
和「八月上游发版文」差在哪
上游 1.37 发版笔记覆盖 KYAML、Gang scheduling、etcd RangeStream、admission 清单配置等大量主题。EKS 这次 What’s New 只点名 Metrics API GA、DRA 设备污点/容忍 GA、HPA 缩到零默认开启这三块,外加升级入口、cluster insights、Distro 分发与区域可用性。做迁移清单时,以托管公告为准;需要完整特性矩阵再去对上游笔记与 EKS 版本文档里的「standard support 重要变更」页。
控制面升到 1.37 之后,节点 kubelet 仍要自己跟。Kubernetes 版本偏差政策允许控制面领先节点最多约三个小版本,但官方仍建议控制面与节点尽量同版本。托管节点组、自管节点、Fargate 都不会随控制面自动升级;Fargate 需要删 Pod 再部署,新 Pod 才会带上与控制面一致的 kubelet。
落地时先核对什么
先确认工作负载是否依赖 metrics.k8s.io 的旧 Beta
路径。v1beta1 在过渡期仍可用,但新集成应直接对准
v1。再用过 DRA
设备池的集群,要复查污点规则与容忍是否会把原可调度的 GPU
任务挡在门外。
准备启用 minReplicas: 0 的团队,指标类型只能是 object 或
external;Object / External metrics 还要自备 metrics adapter(EKS 不预装)。还要评估从零冷启动对 SLA、连接池与下游重试的影响。升级前跑一遍
cluster insights,并单独排期托管节点组、自管节点、Fargate 滚动与 CNI /
CoreDNS / kube-proxy 等 addon。
数字与日期以 AWS What’s New(发布页日期 2026-10-02)与 EKS 版本文档日历(EKS 1.37 记为 2026-10-01)为准。两者差一天,按日历做计划、按公告确认能力即可。本稿未在真实 EKS 集群上跑升级演练。
一起交流
分享你的思考,让讨论更进一步。