阿里云 ACK 容器服务指南与说明:集群类型选择、节点池配置与计费方式

阿里云 ACK 容器服务

阿里云容器服务 Kubernetes 版(Container Service for Kubernetes,简称 ACK)是阿里云提供的全托管 Kubernetes 服务,将阿里云的计算、网络、存储和安全能力与 Kubernetes 标准 API 深度整合,让团队可以在阿里云上运行容器化应用,而不需要自行搭建和维护 Kubernetes 控制面。

ACK 在功能定位上和 AWS EKS、谷歌云 GKE 对等,但在与阿里云自身产品的整合深度上有明显优势——ECS 节点管理、VPC 网络、SLB 负载均衡、OSS 存储、RDS 数据库,在 ACK 控制台内都可以直接配置,不需要额外的适配层。对于已经在阿里云上运行业务的团队,ACK 的学习成本和运维复杂度低于从零开始使用 AWS EKS。

三种集群类型:如何选择

ACK 提供三种集群类型,每种类型在控制面管理方式和计费上有本质差别。2026 年起,ACK 专有集群已停止新建,所有新建集群只能选择托管集群或 Serverless 集群。

托管集群(主流选择)

托管集群的控制面(API Server、etcd、Scheduler、Controller Manager)完全由阿里云管理,用户只需要管理工作节点和部署在上面的应用。托管集群分 Pro 版和基础版。

托管集群 Pro 版是生产环境的推荐选择。Pro 版支持预设控制面资源规格(Pro XL、Pro 2XL、Pro 4XL),可以根据集群规模预先分配固化控制面资源,保障 API Server 在高负载下的响应性能。Pro 版单集群支持最多 15,000 个节点,节点从创建到就绪的时间约 30 秒,扩容 1,000 个节点约 40 秒。Pro 版按集群个数和使用时长收取管理费,按量付费价格为 ¥0.64/小时(约 $88/月),折合年度约 $1,056。

托管集群基础版不收取集群管理费,但在控制面可用性保障、高级调度策略、安全能力等方面有功能限制,适合开发测试环境或对成本极度敏感的小型业务。基础版可以随时热迁移到 Pro 版,不需要重建集群或迁移工作负载。

ACK Serverless(ASK)

ACK Serverless(又称 ASK,Alibaba Cloud Serverless Kubernetes)是完全无节点的 Kubernetes 集群,Pod 直接运行在弹性容器实例(ECI)上,不需要创建、管理或维护任何 ECS 节点。这和 GKE Autopilot 以及 EKS Fargate 的设计思路一致:隐藏节点概念,让用户只关注 Pod 和应用本身。

ASK 的计费按 Pod 实际请求的 CPU 和内存计算,没有空闲节点的浪费,流量高峰时自动扩容,低谷时无需手动缩容节点。控制面同样完全托管,用户只需要维护 Kubernetes YAML 配置和应用镜像。适合流量波动明显、无需对节点做特殊配置的无状态应用,以及希望彻底免除节点运维工作的团队。

专有集群(已停止新建)

专有集群需要用户自行在 ECS 上创建并运维控制面节点,完全掌控控制面配置,灵活性最高但运维负担也最重。阿里云已于 2026 年宣布停止新建专有集群,现有专有集群仍然可以继续使用,但建议评估迁移到托管集群 Pro 版。

集群类型控制面管理节点管理管理费适合场景
托管集群 Pro 版阿里云托管用户自管¥0.64/小时生产环境、大规模集群
托管集群基础版阿里云托管用户自管免费开发测试、成本敏感
ACK Serverless阿里云托管无需管理按 Pod 计费无状态弹性业务
专有集群用户自管用户自管免费已停止新建

创建 ACK 集群

在阿里云控制台进入「容器服务 ACK」,点击「创建集群」,选择集群类型后进入配置页面。以托管集群 Pro 版为例,关键配置项如下:

Kubernetes 版本选择当前最新稳定版,阿里云会在版本进入 End of Life 之前发送升级提醒,建议始终运行受支持的版本。

地域和可用区选择和 ECS 应用服务器相同的地域,跨地域访问 API Server 会增加延迟,同时产生跨地域流量费用。集群创建后地域不能更改。

VPC 和虚拟交换机选择已有 VPC,或者在创建集群时新建。集群的工作节点部署在选定的虚拟交换机对应的可用区,生产集群建议选择多个可用区的交换机,将节点分布在不同可用区,实现跨可用区高可用。关于 VPC 和交换机的规划方式,可以参考 阿里云 VPC 网络配置教程。

Pod 和 Service 网络段:Kubernetes 要求 Pod 网段、Service 网段与 VPC 网段互不重叠。创建集群时需要指定这两个网段,选定后不能修改。典型配置:VPC 用 10.0.0.0/8,Pod 网段用 172.20.0.0/16,Service 网段用 192.168.0.0/16。

用 aliyun CLI 创建托管集群 Pro 版:

aliyun cs POST /clusters –header “Content-Type=application/json” –body ‘{

  “name”: “production-cluster”,

  “cluster_type”: “ManagedKubernetes”,

  “region_id”: “ap-southeast-1”,

  “kubernetes_version”: “1.30.6-aliyun.1”,

  “vpcid”: “vpc-xxxx”,

  “vswitch_ids”: [“vsw-xxxx”, “vsw-yyyy”],

  “pod_cidr”: “172.20.0.0/16”,

  “service_cidr”: “192.168.0.0/16”,

  “num_of_nodes”: 3,

  “master_instance_types”: [“ecs.c6.xlarge”],

  “worker_instance_types”: [“ecs.c6.xlarge”],

  “pro_version”: true

}’

集群创建完成后,通过 kubectl 连接集群:

# 下载 kubeconfig

aliyun cs GET /k8s/production-cluster/user_config > ~/.kube/config

# 验证连接

kubectl get nodes

kubectl cluster-info

节点池配置

节点池是 ACK 中对工作节点进行分组管理的单元,同一节点池内的节点具有相同的规格、操作系统、标签和污点配置。一个集群可以创建多个不同配置的节点池,用于区分不同类型的工作负载。

节点池本身的管理功能免费,只有节点池内的 ECS 实例按 ECS 的计费规则单独计费。关于 ECS 实例规格的选型逻辑,可以参考 阿里云 ECS 完整教程的规格族说明。

多节点池的典型配置方式:

在线服务节点池使用包年包月 ECS,配置 2–4 个节点作为基础容量,保证核心服务的资源稳定性;批处理节点池使用抢占式 ECS,设置最小节点数为 0,空闲时完全缩容,有批处理任务时自动扩容,成本节省 70–80%;GPU 节点池配置 GPU 实例,最小节点数为 0,AI 推理和训练任务调度到 GPU 节点,任务完成后缩容。

# 在节点池中创建 Deployment,通过 nodeSelector 调度到指定节点池

apiVersion: apps/v1

kind: Deployment

metadata:

  name: api-service

  namespace: production

spec:

  replicas: 3

  selector:

    matchLabels:

      app: api-service

  template:

    metadata:

      labels:

        app: api-service

    spec:

      nodeSelector:

        node-type: online-service  # 对应在线服务节点池的标签

      containers:

      – name: api-service

        image: registry.ap-southeast-1.aliyuncs.com/my-repo/api:v1

        resources:

          requests:

            cpu: “500m”

            memory: “1Gi”

          limits:

            cpu: “1”

            memory: “2Gi”

节点池的付费类型决定了后续扩容 ECS 实例的计费方式,在创建节点池时选定,后续修改只对新扩容的节点生效,不影响已有节点。包年包月节点扩容成本相对固定,适合基础节点池;按量付费节点灵活可释放,适合弹性节点池。

2026 年 1 月 31 日起的变更:托管节点池的 kubelet 和容器运行时自动升级配置入口已下线,相关升级通过集群级别的自动升级配置统一管理。存量集群的已有配置不受影响,新建节点池需要通过集群升级功能管理节点组件版本。

弹性伸缩配置

ACK 支持多种自动弹性伸缩机制,应对不同场景的流量波动。

**HPA(Horizontal Pod Autoscaler)**是 Kubernetes 标准的 Pod 水平扩缩容机制,根据 CPU 或内存利用率自动调整 Deployment 的副本数:

apiVersion: autoscaling/v2

kind: HorizontalPodAutoscaler

metadata:

  name: api-service-hpa

  namespace: production

spec:

  scaleTargetRef:

    apiVersion: apps/v1

    kind: Deployment

    name: api-service

  minReplicas: 2

  maxReplicas: 20

  metrics:

  – type: Resource

    resource:

      name: cpu

      target:

        type: Utilization

        averageUtilization: 60

CPU 利用率超过 60% 时,HPA 自动增加副本数,降回 60% 以下后逐步缩容,缩容有 5 分钟的冷却时间防止抖动。

Cluster Autoscaler配合节点池使用,当集群内有 Pod 因资源不足无法调度时,Cluster Autoscaler 自动向节点池发起扩容请求,新节点就绪后 Pod 自动调度。当节点持续空闲超过设定时间,Cluster Autoscaler 自动触发节点缩容并释放 ECS 实例。

ACK 还支持阿里云自研的 AHPA(Adaptive Horizontal Pod Autoscaler),基于历史流量数据和机器学习算法预测未来负载,提前扩容而不是等到利用率已经超标才响应,减少流量突增时的服务降级窗口。

计费方式

ACK 的账单由集群管理费和关联云产品资源费两部分构成。

集群管理费只有托管集群 Pro 版收取,按量付费为 ¥0.64/小时,换算为美元约 $0.09/小时,单集群全月运行约 $65–88(以当期汇率和地域定价为准)。集群管理费不支持停机暂停——ACK 集群不支持休眠状态,暂时不使用的集群只能通过移除或停止节点来降低 ECS 费用,控制面管理费持续计费直到集群被删除。

关联云产品资源费是账单的主体,包括:ECS 节点(按各节点规格和计费方式计费)、CLB 负载均衡(API Server 使用一个 CLB 实例,含实例费和 LCU 流量费)、NAT 网关(集群出公网流量)、公网 IP(如果配置了外部访问)、云盘(节点系统盘和 PVC 数据盘)。

这些关联资源的费用通常比集群管理费高出数倍,在规划 ACK 集群成本时,节点规格和数量是最大的变量。包年包月节点配合节省计划,或者混合使用抢占式实例,是降低节点成本的常见组合。

ACK vs AWS EKS vs 谷歌云 GKE

三个平台的托管 Kubernetes 服务在控制面计费上有明显差别:

  • AWS EKS:每集群 $72/月固定费用,节点按 EC2 计费
  • 谷歌云 GKE Standard:每集群 $72/月,每账号有一个免费的 Zonal 集群
  • 阿里云 ACK 托管基础版控制面免费,节点按 ECS 计费
  • 阿里云 ACK 托管 Pro 版:约 $88/月,节点按 ECS 计费

对于需要运行多个集群(开发、测试、生产各一个)的团队,ACK 基础版的免费控制面是明显的成本优势。多集群场景下,ACK 基础版可以免去每个集群每月 $72 的控制面费用,而 EKS 和 GKE 每个集群都要收这个固定费用。

与 AWS EKS 和 GKE 相比,ACK 在亚太市场(香港、新加坡、日本)的节点资源更充足,和阿里云其他产品(ECS、RDS、OSS、SLB)的整合更深度,适合以亚太为核心市场的出海业务。

账号开通与代理充值

使用 ACK 需要有效的阿里云国际版账号,GPU 节点池的实例规格可能需要单独申请配额。通过 阿里云账号出售 渠道获取的高权重账号,配额更宽松,适合直接用于生产环境集群部署,1 分钟交付,免实名免绑卡。

对于长期运行 ACK 生产集群、月均消耗在 $500 以上的团队,通过 阿里国际合作伙伴 渠道充值可以获得赠金返点($100 到账 $110,$500 到账 $600,$1000 到账 $1250),赠金适用于 ACK 集群管理费、ECS 节点费和所有关联资源费用,年度实际成本明显低于官网直充,支持 USDT 和对公转账。

阿里云代理

滚动至顶部