설명
ACK의 노드 자동 복구는 지원되는 노드 이상을 확인하고 복구 작업을 수행합니다. 기능이 꺼져 있으면 장애 처리에 수동 작업이나 별도 자동화가 필요합니다.
잠재적 영향
장애 노드의 복구가 늦어져 워크로드 가용성이 낮아질 수 있습니다.
해결 방법
관리형 노드 풀에 management.enable = true와 auto_repair = true를 설정하세요. 재시작과 동시 중단 한도가 워크로드에 미치는 영향을 확인하세요.
예시
관리형 기능과 자동 복구를 활성화하는 발췌 예시입니다. 노드 인증과 디스크 설정은 생략했으며, 자동 업그레이드 등 함께 표시된 운영 옵션도 검토하세요.
변경 전
hcl
resource "alicloud_cs_kubernetes_node_pool" "default" {
name = var.name
cluster_id = alicloud_cs_managed_kubernetes.default.0.id
vswitch_ids = [alicloud_vswitch.default.id]
instance_types = [data.alicloud_instance_types.default.instance_types.0.id]
desired_size = 1
}
변경 후
hcl
resource "alicloud_cs_kubernetes_node_pool" "default" {
name = var.name
cluster_id = alicloud_cs_managed_kubernetes.default.0.id
vswitch_ids = [alicloud_vswitch.default.id]
instance_types = [data.alicloud_instance_types.default.instance_types.0.id]
desired_size = 1
management {
enable = true
auto_repair = true
auto_upgrade = true
surge = 1
max_unavailable = 1
}
}