Sunucu Yönetimi
Sunucu Yönetimi
Sunucularınız var mı? İşletmesini devralırız: izleme, yama, yedek ve arayabileceğiniz bir insan.
Onları izlemek işi olan biri
Sunucular nadiren gürültüyle bozulur. Diskleri dolar. Bir yedeği kaçırırlar. Sekiz ay boyunca yamalanmamış bir servisi çalıştırırlar, çünkü ondan haberi olan kişi iş değiştirmiştir. Yönetim büyük ölçüde bu şeyleri hâlâ sıkıcıyken fark etme disiplinidir.
Elinizde zaten olan sunucuların — bizim ya da bir başkasının — işletmesini devralıyor ve bu disiplini gerçekten birinin sorumluluğu hâline getiriyoruz.
Neleri üstleniyoruz
- İzleme: erişilebilirlik, disk payı, bellek baskısı, sertifika süresi ve dün gecenin yedeğinin gerçekten bitip bitmediği.
- Takvimli yama; değişiklikler gece ikide sessizce uygulanmaz, kayda geçer.
- Yedek doğrulama. Kimsenin geri dönmediği bir yedek, yedek değil; dosya adı olan bir umuttur.
- Sıkılaştırma: güvenlik duvarı kuralları gözden geçirilir, erişim listesi gözden geçirilir, artık kimsenin kullanmadığı servisler kapatılır.
- Günlük incelemesi; kesintiden sonra gelen desenler değil, öncesinde gelenler için.
- Arayabileceğiniz bir kişi; aradığınızda envanter önünde duran biri.
Yedekler: herkesin sorunsuz varsaydığı kısım
Yaygın kullanılan temel, 3-2-1 kuralıdır: verinin üç kopyası, iki farklı ortam türünde, bir kopya bina dışında. Tek nokta arızalarını kaldırmak için vardır — bozulan bir disk size bir kopyaya mal olur, yangın ya da fidye yazılımı aynı binadaki kopyaların tümüne.
Kuralı işler hâle getiren iki sayı var. RPO (kurtarma noktası hedefi), yedekler arasındaki süreyle ölçülen, kaybetmeyi göze alabileceğiniz veri miktarıdır. RTO (kurtarma süresi hedefi), geri dönüşün ne kadar sürmesini kaldırabileceğinizdir. Dört saatlik RTO ile bir saatlik RPO net bir çıtadır; bu sayılar yazılı değilse yedek sıklığı ve saklama süresi tahminden ibarettir.
Bir de hepsinin işe yarayıp yaramadığına karar veren kısım var: geri dönüş testi. Yedekleme işleri sessizce ve sıkıcı sebeplerle başarısız olur — bir iş aylarca "başarılı" raporlarken, kendisi yazıldıktan sonra eklenmiş bir bölümü atlıyordur. Arıza, ihtiyaç duyulan güne kadar görünmez. İşleyen bir ritim şu: aylık dosya düzeyinde geri dönüş, üç ayda bir uygulama düzeyinde kurtarma, yılda bir tam ortam tatbikatı.
Bu döngüyü biz yürütüyor ve bulduklarını — bir şey bulduğu zamanlar dahil — raporluyoruz.
Devralınan bir kurulumu üstlenmek
İşe gerçekte neyin çalıştığını belgeleyerek başlıyoruz, çünkü devralınan sunucular kendileriyle gelen belgelere neredeyse hiç uymuyor. O ilk tarama genelde aynı şeyleri ortaya çıkarıyor: biten bir projeden kalma, hâlâ dinleyen bir servis; kimsenin açıklayamadığı bir zamanlanmış görev; iki yıl önce işi biten bir yüklenicinin SSH anahtarı; aynı makinedeki bir diske yazan bir yedek.
Bizimle devam etseniz de etmeseniz de o envanter sizin oluyor. Sunucularla ilgili her karar için dürüst başlangıç noktası odur — onları başka bir yere götürme kararı dahil.
Kendi ekibiniz, olay bazlı destek ya da yönetilen hizmet
| Bozulunca birini aramak | Yönetilen | Kendi ekibiniz | |
|---|---|---|---|
| Yama | Bir şey zorladığında | Takvimle | Sizin takviminizle |
| Yedek testi | Nadiren | Döngüyle, raporlanarak | Sahibi varsa |
| Belgelendirme | Geriye ne kaldıysa | Güncel tutulur | Ekip sirkülasyonuna bağlı |
| Maliyetin biçimi | Öngörülemez, olaya bağlı | Sabit aylık | Maaşlar |
| Kime uygun | Düşük riskli sistemler | İşin üzerinde döndüğü sistemler | Büyük ya da uzmanlaşmış ortamlar |
Ne zaman size uygun değiliz
- Bu işi yapan bir sistem ekibiniz zaten varsa. Aynı disipline iki kez ödemenin anlamı yok.
- Her saat, her konu için ulaşılabilir biri istiyorsanız. Bunu baştan açıkça söyleyin ki yanıt beklentisi varsayılmasın, yazılsın.
- Sunucularda artık desteği olmayan bir yazılım çalışıyorsa. Riski belgeleyebiliriz ama artık yama almayan bir şeyi yamalayamayız.
İlk otuz gün
Bir başkasının sunucularını devralmak, neyin doğru olduğunu öğrenmekle başlar ve bu, belgelerde yazanla nadiren aynıdır. İlk ay her seferinde aynı biçimi izler.
- Envanter. Ne kurulu, hangi portta ne dinliyor, zamanlanmış olarak ne çalışıyor, diskler nasıl görünüyor, yedekler nereye gidiyor ve hiç geri dönülmüş mü.
- Erişim denetimi. Kimin hesabı var, kim hâlâ orada çalışıyor, hangi anahtarlar işi bitmiş yüklenicilere ait, hangi kimlik bilgileri kişiler arasında paylaşılıyor.
- Önce acil riskler. Yamalanmamış ve internete açık ne varsa, gereksiz yere root olarak çalışan ne varsa, yedeklediği makinenin kendisine yazan yedekler.
- Temel çizgi. İzleme bağlanır ki karşılaştırılacak bir "normal" olsun; o olmadan "sunucu yavaş gibi" cümlesi yanıtlanamaz.
- Yazılı plan. Ne bulduk, neyi düzelttik, sırada neyi öneriyoruz ve bu neye bağlı.
Sonrasında ne karar verirseniz verin o plan sizin. Bir aylık belgelendirmenin değeri, sunucular başka bir yere gitse de kalır.
"Takvimli yama" pratikte ne demek
Her güncellemeyi çıktığı anda uygulamak bir strateji değildir — bir işletmenin, küçük bir sürüm atlamasının davranışı değiştirdiğini cuma günü saat dörtte keşfetme biçimidir. Bir şey zorlayana kadar hiçbir şey uygulamamak ise diğer başarısızlıktır ve daha yaygın olanıdır.
İşleyen orta yol, iki şeritli tanımlı bir ritimdir. Aktif olarak sömürülen güvenlik güncellemeleri hızla, size bir notla birlikte uygulanır. Geri kalan her şey planlı bir pencerede toplanır, varsa önce bir deneme kopyasına uygulanır ve kayda geçer — ne değişti, ne zaman, neye dokundu.
Kayıt, insanların atladığı ve karşılığını veren kısımdır. Bir uygulama salı günü farklı davranmaya başladığında soru her zaman "ne değişti?" olur ve güncel tutulmuş bir değişiklik günlüğü, bir günlük incelemeyi beş dakikalık bir kontrole çevirir.
Yeniden başlatma gerektiren güncellemeler — özellikle çekirdek yamaları — geldikleri anda değil, sizinle birlikte planlanarak uygulanır.
Sık sorulan sorular
Başka yerden aldığımız sunucuları yönetebilir misiniz?
Evet, olağan durum bu. Gerçekte neyin çalıştığının envanteriyle başlıyoruz, çünkü devralınan sunucular belgelerine nadiren uyuyor; sonrasında ne karar verirseniz verin o envanter sizde kalıyor.
Yedeklerimizin gerçekten çalıştığını nasıl biliyorsunuz?
Geri dönerek. Yedekleme işleri bir bölümü atlarken aylarca "başarılı" raporlayabiliyor; dolayısıyla sayılan tek kanıt, kullanılabilir veri üreten bir geri dönüş. Belirli bir döngüyle test ediyor ve sonuçları — bir test sorun bulduğunda da — raporluyoruz.
Yama kesintiye yol açar mı?
Güncellemelerin çoğu yeniden başlatma gerektirmiyor. Gerektirenler — özellikle çekirdek güncellemeleri — geldiği anda değil, sizinle kararlaştırılan bir pencerede uygulanıyor. Değişiklikler kayda geçtiği için sonrasında bir şey farklı davranırsa bakılacak bir liste oluyor.
İzleme tam olarak neyi kapsıyor?
Erişilebilirlik, disk payı, bellek baskısı, sertifika süresi ve yedeğin tamamlanması. Son ikisi kulağa geldiğinden önemli: süresi dolmuş bir sertifika siteyi her ziyaretçinin gözü önünde düşürür, sessizce başarısız olan bir yedek ise ancak ihtiyaç duyulduğunda fark edilir.
Kendi sunucularımıza erişimimizi kaybeder miyiz?
Hayır. Erişim, sizin karar verdiğiniz bir düzen: bazı müşteriler root'u kendinde tutup belirli işler için bizi arıyor, bazıları günlük erişimin bizde, hesabın kendilerinde olmasını tercih ediyor. Yazılı olduğu sürece ikisi de sorunsuz.
Sizinle çalışmayı bırakırsak ne oluyor?
Belgeler, erişimler ve envanter sizde kalıyor. Kurulumun hiçbir parçası işletmeye devam etmemize bağlı değil; devri zorlaştırmak ilgilendiğimiz bir tutundurma yöntemi de değil.