Tempah Konsultasi Hantar Tiket

Autoscaling Kapasiti Awan dan Operasi Kos: Panduan Praktikal

Ketahui cara mengimbangi kapasiti dan kos semasa migrasi awan menggunakan autoscaling Kubernetes (HPA, VPA, Cluster Autoscaler), termasuk diagnosis, arahan, kawalan risiko, dan prosedur balik.

Autoscaling Kapasiti Awan dan Operasi Kos: Panduan Praktikal
Cloud Migration 6min 58 paparan 2026-06-26
Kubernetesautoscalingpengoptimuman kos

Senario

Syarikat sedang memindahkan platform e-dagang ke awan. Trafik berubah-ubah dengan puncak semasa promosi. Pada mulanya, pasukan menskala nod dan pod secara manual, menyebabkan penggunaan sumber rendah (purata 30%) dan kos tinggi. Matlamat adalah mengoptimumkan kos melalui autoscaling sambil mengekalkan prestasi.

Gejala

  • Bil awan meningkat 20%+ bulan ke bulan, tetapi penggunaan CPU/memori median di bawah 40%.
  • Semasa waktu puncak, kelewatan permulaan pod dan tamat masa permintaan (kadar ralat 5xx >2%).
  • Bilangan nod kekal malar semasa tempoh beban rendah.

Diagnosis

  1. Semak permintaan/had sumber pod: kubectl describe pods -n production – sesetengah bekas mempunyai permintaan berlebihan.
  2. Periksa status HPA: kubectl get hpa -n production – HPA tidak dikonfigurasi atau ambang tidak sesuai.
  3. Analisis penggunaan nod: kubectl top nodes dan pemantauan awan (contohnya AWS CloudWatch).
  4. Periksa log Cluster Autoscaler: kubectl logs -n kube-system cluster-autoscaler-xxx untuk peristiwa penskalaan.

Arahan

Konfigur HPA (berasaskan CPU)

kubectl autoscale deployment my-app --cpu-percent=60 --min=3 --max=20 -n production

Dayakan VPA (tetapkan had min/maks)

apiVersion: autoscaling.k8s.io/v1
kind: VerticalPodAutoscaler
metadata:
  name: my-app-vpa
spec:
  targetRef:
    apiVersion: "apps/v1"
    kind: Deployment
    name: my-app
  updatePolicy:
    updateMode: "Auto"
  resourcePolicy:
    containerPolicies:
    - containerName: "*"
      minAllowed:
        cpu: 100m
        memory: 100Mi
      maxAllowed:
        cpu: 1
        memory: 1Gi

Konfigur Cluster Autoscaler (contoh AWS)

kubectl edit deployment/cluster-autoscaler -n kube-system
# Tambah argumen --nodes=1:10:eks-worker-group-1

Kawalan Risiko

  • Tetapkan replika min/maks HPA untuk mengelak penskalaan agresif.
  • Gunakan PodDisruptionBudget untuk perkhidmatan kritikal:
apiVersion: policy/v1
kind: PodDisruptionBudget
metadata:
  name: my-app-pdb
spec:
  minAvailable: 2
  selector:
    matchLabels:
      app: my-app
  • Dayakan amaran belanjawan awan (contohnya GCP Budget Alerts).
  • Lancar secara berperingkat: uji dalam persekitaran ujian dahulu, kemudian canary dalam pengeluaran.

Balik

Jika masalah timbul (contohnya lonjakan kos akibat penskalaan berlebihan atau ketidakstabilan): 1. Hentikan Cluster Autoscaler: kubectl scale deployment/cluster-autoscaler --replicas=0 -n kube-system 2. Kembalikan HPA: kubectl delete hpa my-app -n production atau laraskan ambang. 3. Jika VPA menyebabkan but semula, padam VPA: kubectl delete vpa my-app-vpa -n production 4. Tetapkan replika deployment secara manual: kubectl scale deployment my-app --replicas=5 -n production

Pengesahan

  • Periksa peristiwa penskalaan: kubectl describe hpa my-app -n production – lihat Last Scale Time.
  • Pemantauan kos: bandingkan bil awan mingguan; penggunaan sepatutnya meningkat melebihi 60%.
  • Prestasi: kadar ralat 5xx puncak <1%, kependaman P95 <200ms.

Bila Serahkan Tiket OpsGlobal

  • Autoscaling masih tidak berfungsi atau menyebabkan ayunan teruk selepas mengikuti langkah.
  • Perlukan pengoptimuman untuk senario kompleks (contohnya HPA metrik tersuai, strategi penskalaan pelbagai).
  • Pertumbuhan kos luar biasa (contohnya gangguan Spot Instance kerap menyebabkan migrasi).
  • Bilangan nod mencapai had kuota awan; perlukan pelarasan akaun.

Pakar SRE OpsGlobal boleh campur tangan dalam 30 minit untuk membantu mengkonfigurasi autoscaling gred pengeluaran dan menyediakan papan pemuka tadbir urus kos.

Senario Penggunaan

Sesuai untuk pasukan yang menyelesaikan isu Cloud Migration dan memerlukan aliran kerja yang jelas.

Latar Belakang Masalah

Ketahui cara mengimbangi kapasiti dan kos semasa migrasi awan menggunakan autoscaling Kubernetes (HPA, VPA, Cluster Autoscaler), termasuk diagnosis, arahan, kawalan risiko, dan prosedur balik.

Langkah Penyelesaian

Sahkan impak dan perubahan terkini, kumpul log, konfigurasi dan metrik, kemudian baiki mengikut risiko.

Contoh Arahan

Gantikan contoh dengan nama sumber sebenar dan simpan kata laluan, token atau kunci dalam pembolehubah persekitaran.

Risiko

Sebelum operasi produksi, semak sandaran, akses, tetingkap perubahan dan pelan rollback.

Pelan Rollback

Simpan konfigurasi dan versi asal; rollback konfigurasi, imej atau perubahan pangkalan data jika metrik tidak normal.

Senarai Serahan

Rekod punca isu, arahan penting, langkah pembaikan, hasil pengesahan dan cadangan susulan.

!

Perlu bantuan isu teknikal serupa?

Jika pelayan, Kubernetes, Docker, CI/CD, pangkalan data atau pemantauan anda bermasalah, hantar log dan konfigurasi untuk diagnosis jauh.

Tiket Hubungi WhatsApp Konsultasi