HPA正常工作的前提是Go应用部署在Deployment中、显式设置resources.requests、集群已部署metrics-server且API可用;缺一不可。

Go 应用本身不需要特殊“部署逻辑”来支持 HPA —— 只要它跑在 Deployment 里、设置了 resources.requests、集群装了 metrics-server,HPA 就能工作。你不是在 Go 代码里写 HPA,而是在 Kubernetes 里给 Go 应用配一个 HorizontalPodAutoscaler 资源对象。
Go 应用必须设置 resources.requests 才能被 HPA 识别
HPA 计算 CPU/内存利用率时,分母是 requests(不是 limits,也不是实际使用量)。如果没设 requests,HPA 会直接报错:failed to get cpu utilization: missing request for cpu。
-
requests.cpu和requests.memory必须显式写进 Deployment 的容器 spec 里,哪怕只是100m和128Mi - Go 程序启动快、内存增长相对平缓,但别因此省略 requests —— 缺失它,HPA 根本不会开始采集指标
- 如果你用
go run或本地调试模式部署,很容易漏掉这一项;CI/CD 流水线里建议加 YAML lint 检查,比如用conftest或kubeval验证resources.requests是否存在
HPA 必须用 autoscaling/v2 API 版本,别用 v1
autoscaling/v1 只支持 CPU,且已被标记为 deprecated;v2 支持 CPU、内存、自定义指标,字段语义更清晰,是当前唯一推荐版本。用 v1 写的 HPA 在 1.26+ 集群可能无法创建或行为异常。
- spec 里必须写
apiVersion: autoscaling/v2,不是v1或autoscaling/v2beta2 -
metrics字段结构不同:v2 用数组描述多个指标,每个含type(Resource/Object/Pods)、resource、target;v1 只有cpu和memory两个固定字段 - 示例关键片段:
apiVersion: autoscaling/v2 kind: HorizontalPodAutoscaler metadata: name: go-api-hpa spec: scaleTargetRef: apiVersion: apps/v1 kind: Deployment name: go-api minReplicas: 2 maxReplicas: 10 metrics: - type: Resource resource: name: cpu target: type: Utilization averageUtilization: 70
HPA 不起作用?先检查 metrics-server 是否就绪
HPA 控制器自己不采集指标,它只调用 metrics.k8s.io API。这个 API 由 metrics-server 提供。如果它没运行或配置错误,kubectl get hpa 会显示 unknown 或 not found,kubectl describe hpa 里常见错误是:failed to get cpu utilization: unable to get metrics for resource cpu: no metrics returned from resource metrics API。
- 运行
kubectl top nodes和kubectl top pods—— 如果都报错或返回空,基本可断定metrics-server没生效 - 检查 Pod 状态:
kubectl get pod -n kube-system | grep metrics-server,确保 Running 且 Ready 1/1 - 常见坑:
--kubelet-insecure-tls参数没加(内网环境常用),或镜像拉取失败(建议换阿里云镜像源,如registry.aliyuncs.com/google_containers/metrics-server:v0.8.1) - API Aggregator 必须开启:确认
kube-apiserver启动参数含--enable-aggregator-routing=true,否则/apis/metrics.k8s.io/路径根本不存在
RBAC 权限和命名空间容易被忽略
用 client-go 或 CI/CD 工具创建 HPA 时,执行者(ServiceAccount)必须有权限操作 horizontalpodautoscalers 资源,且目标 Deployment 必须与 HPA 在同一命名空间。
- RABC 规则至少包含:
apiGroups: ["autoscaling"] resources: ["horizontalpodautoscalers"] verbs: ["create", "update", "get", "list"]
-
scaleTargetRef.name必须指向同 namespace 下已存在的 Deployment —— 如果跨 namespace,HPA 会卡在Waiting for rollout to finish状态,kubectl describe hpa显示target not found - Go 应用若部署在非
default命名空间(比如prod),HPA 的metadata.namespace和scaleTargetRef对应的 Deployment namespace 都得显式写对
真正卡住人的往往不是 HPA YAML 写错,而是 metrics-server 没通、requests 漏设、RBAC 权限没给全、或者 Deployment 还没创建成功就急着 apply HPA —— 这四个点,检查顺序建议按上面副标题的顺序来,90% 的“HPA 不工作”问题都能当场定位。


















