Auto-Scaling & Self-Healing
Trafik ve kaynak kullanımına göre otomatik ölçekleme. Sorunlu pod'ların otomatik yeniden başlatılması ile %99,9 uptime.
Otomatik Ölçeklendirme
Trafik artışlarına anında yanıt veren akıllı ölçeklendirme
Horizontal Pod Autoscaler
CPU ve memory kullanımına göre pod sayısını otomatik artırıp azaltır. Eşik değerleri iş yükünün gerçek davranışına göre belirlenir; ortalamaya göre değil, gözlenen yüksek yüzdelik dilimlere bakarız. Alt ve üst replika sınırı tanımlı olduğu için ölçekleme kontrolden çıkmaz.
Vertical Pod Autoscaler
Pod'ların kaynak limitleri otomatik ayarlanır. Right-sizing ile maliyet optimizasyonu.
Cluster Autoscaler
İhtiyaç halinde cluster'a yeni node'lar otomatik eklenir. Boş node'lar kaldırılır.
Custom Metrics Scaling
Kuyruk derinliği, saniyedeki istek sayısı gibi uygulamaya özel metriklere göre ölçeklendirme. CPU çoğu zaman gecikmeyi haber vermez; kuyruk uzunluğu gibi doğrudan iş yüküne bağlı bir metrik, yükü çok daha erken yakalar.
Otomatik İyileşme
Liveness Probes
Sağlık kontrolü başarısız olan container'lar otomatik yeniden başlatılır. Buradaki kritik ayar, kontrolün uygulamanın gerçekten çalıştığını ölçmesi ve açılış süresi uzun uygulamalar için başlangıç toleransı tanımlanmasıdır. Yanlış ayarlanmış bir kontrol, sağlıklı podu sürekli yeniden başlatır.
Readiness Probes
Hazır olmayan pod'lara trafik yönlendirilmez. Yeni sürüm açılırken istekler yalnızca hazır podlara gider, böylece dağıtım sırasında kullanıcı hata görmez. Kapanan podlarda da açık bağlantıların düzgün sonlandırılması için bekleme süresi tanımlanır.
Node Failure Recovery
Node arızasında podlar sağlıklı node'lara otomatik taşınır. Taşımanın gerçekten çalışması için iş yüklerinin baştan birden fazla node'a yayılmış olması gerekir; aksi halde tek bir düğüm arızası tüm replikaları birden götürür. Bu yayılımı kurulum aşamasında tanımlıyoruz.
Merak edilenler
Auto-scaling her uygulama için uygun mu?
Hayır. Durum bilgisini kendi belleğinde tutan, oturum bilgisini diske yazan ya da açılışı dakikalar süren uygulamalar yatay ölçeklemeye uygun değildir. Bu tür iş yüklerinde önce uygulamanın durumu dışarı taşınır, ölçekleme ondan sonra devreye alınır.
HPA ve VPA aynı anda kullanılabilir mi?
Aynı kaynak üzerinde ikisini birden çalıştırmak çakışma üretir, çünkü biri replika sayısını diğeri kaynak limitini aynı sinyale bakarak değiştirir. Yaygın çözüm, yatay ölçeklemeyi CPU ya da özel bir metrik üzerinden yürütmek ve dikey ölçeklemeyi yalnızca öneri modunda kullanmaktır.
Ölçekleme ne kadar sürede devreye giriyor?
Süre üç parçadan oluşur: metriğin toplanma aralığı, yeni podun başlayıp hazır hale gelmesi ve gerekiyorsa yeni bir node açılması. Mevcut node üzerinde yer varsa saniyeler mertebesindedir; yeni node açılması gerekiyorsa birkaç dakikaya çıkar. Ani yük artışları için önden kapasite bırakmak gerekir.
Pod sayısı artınca maliyet kontrolden çıkar mı?
Çıkmaması için iki sınır birlikte tanımlanır. Uygulama tarafında azami replika sayısı, cluster tarafında ise açılabilecek azami node sayısı belirlenir. Böylece hatalı bir metrik ya da beklenmeyen bir trafik, faturayı sınırsız büyütemez. Bu sınırların maliyet tarafındaki karşılığını maliyet hesabı yazımızda ayrıntılı anlattık.
Otomatik yeniden başlatma veri kaybına yol açar mı?
Doğru yapılandırıldığında hayır. Pod kapatılırken önce trafik kesilir, ardından uygulamaya açık işlemleri tamamlaması için tanımlı bir süre verilir. Bu süre ve kapanış kancası ayarlanmamışsa yarıda kalan istekler görülebilir, bu yüzden kurulumda ikisini birlikte tanımlıyoruz.
Kesintisiz Hizmet için
Auto-Scaling Başlayın
Ücretsiz danışmanlık görüşmesi için iletişime geçin.
