İyi Bir Sistem Yöneticisinin Günlük Alışkanlıkları: Sürdürülebilir Operasyonlar İçin Pratik Rutinler
Sistem yöneticiliğinde sürdürülebilir başarı, anlık kriz müdahalelerinden ziyade günlük oturtulan sağlam alışkanlıklar ve proaktif rutinlerle gelir. Bu yazıda, usta sysadmin’lerin operasyonel yükü azaltan ve güvenliği artıran günlük pratiklerini inceliyoruz.
Caner Serbest
Sistem ve Altyapı
5 dk okuma
İyi Bir Sistem Yöneticisinin Günlük Alışkanlıkları: Sürdürülebilir Operasyonlar İçin Pratik Rutinler
Yazar: Caner Serbest
Kategori: Kariyer
Sistem yöneticiliği (Sysadmin) dünyasında yeni olanlar genellikle işin heyecanlı kısmına odaklanır: Sıfırdan bir Kubernetes kümesi kurmak, büyük bir veri tabanı migrasyonu gerçekleştirmek veya karmaşık bir ağ mimarisini ayağa kaldırmak. Bunlar şüphesiz teknik gelişimin kritik kilometre taşlarıdır. Ancak yıllar geçtikçe ve yönetilen sistemlerin ölçeği büyüdükçe, gerçek başarının kahramanlık gerektiren büyük kriz anlarını başarıyla atlatmaktan değil, o krizlerin hiç doğmamasını sağlayan sessiz, istikrarlı ve sürdürülebilir rutinlerden geçtiğini fark edersiniz.
İyi bir sistem yöneticisini sıradan bir teknisyenden ayıran şey, sahip olduğu araç bilgisi kadar (Linux, Docker, AWS, VMware vb.) gününü nasıl yapılandırdığıdır. Kaosun ortasında sükûneti korumak, sorunları büyümeden yakalamak ve operasyonel yükü minimumda tutmak belirli alışkanlıkların bir sonucudur.
Bu yazıda, saha deneyimlerine dayanarak, iyi bir sistem yöneticisinin günlük olarak uygulaması gereken pratik alışkanlıkları, otomasyon ipuçlarını ve zihniyet modellerini ele alacağız.
1. Güne Kontrol Listeleriyle (Checklist) Başlamak
Günlük rutinin ilk ve belki de en kritik adımı, güne ne durumda olduğunuzu bilerek başlamaktır. İnsan hafızası yanılmaya müsaittir ve sabah kahvesini yudumlarken gelen ilk e-posta dikkatinizi ana odaklardan uzaklaştırabilir.
Sistem yöneticisi, mesaiye başladığında ilk olarak kritik metriklerin ve servislerin sağlık durumunu (Health Check) gözden geçirmelidir. Bu kontrolü manuel olarak yapmak bir süre sonra ezbere dönüşür ve gözden kaçan detaylar büyük sorunlara yol açabilir.
Bunu otomatize etmek veya standartlaştırmak için basit bir kontrol listesi (tercihen terminal tabanlı veya bir araç üzerinde) kullanın:
- Anahtar sunucuların erişilebilirlik durumu (Ping/ICMP ve SSH yanıt süreleri).
- Disk doluluk oranları (Özellikle
/var,/tmpve log dizinleri). - Sistem kaynak tüketimi (CPU, RAM ve I/O darboğazları).
- Son 24 saatteki kritik hata logları.
Bu kontrolü yapmak için her sabah şu basit Bash betiğinden ilham alan hızlı bir özet komutu çalıştırabilirsiniz:
#!/bin/bash
echo "=== Disk Kullanımı ==="
df -h | grep -E '^/dev/'
echo -e "
=== Bellek Durumu ==="
free -m
echo -e "
=== Son Kritik Hatalar (Systemd) ==="
journalctl -p err -n 5 --no-pager
Bu tarz küçük betikler veya Prometheus/Grafana gibi araçlar üzerindeki özet paneller, güne “durum tespiti” ile başlamanızı sağlar.
2. Log İncelemesini Reaktif Değil, Proaktif Hale Getirmek
Çoğu junior sistem yöneticisi logları yalnızca bir sistem çöktüğünde veya kullanıcılar şikâyet ettiğinde inceler. Bu, yangını söndürmeye çalışmaktır; oysa amacımız yangın çıkmasını engellemek olmalıdır.
İyi bir sistem yöneticisi, log incelemesini günlük rutininin ayrılmaz bir parçası yapar. Tabii ki milyonlarca satırlık logu tek tek okumazsınız. Bunun yerine anomalileri tespit edecek mekanizmalar kurar ve bu mekanizmaların çıktısı olan özet raporları gözden geçirirsiniz.
- Yetkisiz Erişim Denemeleri: SSH loglarında (özellikle
/var/log/auth.logveyasecure) sürekli başarısız root girişi denemeleri var mı? - Servis Hataları: Nginx veya Apache hata loglarında artış trendi gösteren 5xx HTTP yanıtları bulunuyor mu?
- Donanım Uyarıları: RAID kartı uyarıları, disk S.M.A.R.T. hataları veya yüksek sıcaklık logları sisteme düşmüş mü?
Günlük rutininize 15 dakikalık bir “Log Avı” eklemek, ileride yaşayacağınız saatlerce sürecek kesintilerin önüne geçecektir.
3. Dokümantasyonu “Sonraya” Değil, “Anında” Güncellemek
Sistem yöneticilerinin en yaygın zaaflarından biri dokümantasyondan nefret etmektir. “Şu an acil çözmem lazım, sonra yazarım” cümlesi, teknoloji dünyasının en büyük yalanıdır. O “sonra” asla gelmez ve o an yapılan kritik bir konfigürasyon değişikliği, aylar sonra başka bir arızada başınıza bela olur.
İyi bir sysadmin, yaptığı işin bir parçasının da o işi dokümante etmek olduğunu bilir. Bir sunucuda elle (manual) bir ayar değiştirdiğinizde, bir servis portunu güncellediğinizde veya yeni bir güvenlik duvarı kuralı eklediğinizde:
- Değişikliği anında iç Wiki sisteminize (Notion, Confluence, Outline vb.) veya Git tabanlı depo (Markdown dosyaları) içine işleyin.
- Değişikliğin neden yapıldığını kısaca açıklayın.
- Mümkünse bu süreçleri Ansible, Terraform veya Bash betikleriyle “Infrastructure as Code” (Kod Olarak Altyapı) yaklaşımına taşıyarak manuel müdahale alanını daraltın.
Eğer bir sorunu çözerken terminale yazdığınız komutları bir kenara kaydetmiyorsanız, yarın aynı sorunla tekrar karşılaştığınızda tekerleği yeniden icat ediyorsunuz demektir.
4. Yedekleme Kontrolünü Atlamamak
“Yedek almayan sistem yöneticisi değildir, yedekten dönme testi yapmayan ise iyimserdir.” Bu söz, bilişim sektörünün en gerçekçi kuralıdır.
Otomatik yedekleme betiklerinizin her gece başarıyla çalıştığını gösteren yeşil logları görmek güzeldir; ancak o yedeklerin gerçekten çalışabilir durumda olup olmadığını test etmediğiniz sürece o yedekler sadece birer psikolojik rahatlıktır.
İyi bir sistem yöneticisinin haftalık, bazı kritik sistemler için ise günlük rutinlerinden biri yedek bütünlüğünü doğrulamaktır:
- Yedek dosyalarının boyutları tutarlı mı? (Ani bir düşüş, verinin eksik alındığının göstergesi olabilir).
- Buluta aktarılan (AWS S3, Google Drive vb.) yedekler eksiksiz yüklenmiş mi?
- Ayda en az bir kez, rastgele seçilen bir yedeği izole bir test ortamında geri yükleme (restore) testi yapıyor musunuz?
Yedek almak bir süreçtir, geri yükleyebilmek ise bir yetenektir. Rutinlerinize doğrulama adımlarını mutlaka dahil edin.
5. Güvenlik Güncellemelerini Disiplinli Yönetmek
Sistemleri güncel tutmak, özellikle üretim (production) ortamlarında hassas bir konudur. “Çalışan şeye dokunma” felsefesi bir yere kadar mantıklı olsa da, güvenlik yamalarını göz ardı etmek bir zaman pensesidir.
Kötü bir sistem yöneticisi ya her gün rastgele güncellemeler yapıp sistemi patlatır ya da hiç güncelleme yapmayıp ilk zero-day açığında sistemin ele geçirilmesini izler. İyi bir sistem yöneticisi ise disiplinli ve planlı bir yama yönetimi (Patch Management) alışkanlığına sahiptir:
- Güncellemeleri önce test veya staging ortamında uygulayın.
- Kritik güvenlik yamalarını (Kernel güncellemeleri, OpenSSL açıkları vb.) belirli bir takvim çerçevesinde (örneğin ayda bir kez belirlenen bakım penceresinde) devreye alın.
- Güncelleme sonrasında servislerin otomatik ayağa kalkıp kalkmadığını kontrol edin.
Unutmayın, güvenlik bir ürün değil, süreklilik arz eden bir süreçtir.
6. Otomasyona Yatırım Yapmak (Zaman Kazanmak İçin Zaman Harcamak)
Eğer bir görevi günde iki kezden fazla manuel olarak yapıyorsanız, onu otomatize etme vakti gelmiştir. Sistem yöneticiliğinin en büyük tuzağı, operasyonel işlerin altında ezilip stratejik geliştirmelere vakit bulamamaktır.
İyi bir sysadmin, her gün rutin işlerini otomatikleştirmek için bilinçli olarak zaman ayırır:
- Sertifika yenileme işlemlerini Certbot ve cron/systemd timer ile otomatik hale getirmek.
- Yeni sunucu kurulumlarını bir Bash veya Ansible playbook standardına bağlamak.
- Sık karşılaşılan hata durumları için uyarı mekanizmaları kurmak.
Otomasyon yazmak başta zaman alır gibi görünür; ancak uzun vadede size kazandırdığı zaman ve zihinsel rahatlık paha biçilemezdir.
7. Sürekli Öğrenme ve Laboratuvar Ortamı (Homelab) Kullanımı
Teknoloji dünyası durmaksızın değişiyor. Bugün kullandığınız araçlar yarın obsolète (kullanımdan kalkmış) olabilir. İyi bir sistem yöneticisi, iş saatleri dışında da teknik merakını canlı tutar.
Evde veya bulutta küçük bir Homelab ortamı bulundurmak, yeni teknolojileri (Docker, Kubernetes, Proxmox, yeni Linux dağıtımları, ağ protokolleri vb.) risk almadan denemek için mükemmel bir fırsattır. Günlük işlerinizin stresinden uzak, üretim ortamını patlatma korkusu olmadan komut satırında yeni şeyler denemek, teknik kaslarınızı zinde tutar.
Haftada sadece 2-3 saat bile olsa yeni bir aracı kurup konfigüre etmek, kariyerinizin uzun vadeli sürdürülebilirliği için kritik bir yatırımdır.
Sonuç
Sistem yöneticiliği, kriz anlarında sergilenen bireysel kahramanlıklarla değil, sıradan günlerde gösterilen istikrarlı disiplinle icra edilir. Güne kontrol listeleriyle başlamak, logları proaktif olarak incelemek, dokümantasyonu aksatmamak, yedekleri test etmek ve otomasyona yatırım yapmak; sizi sürekli koşturan bir “itfaiyeci”den, sistemlerini öngören ve yöneten profesyonel bir “mimar”a dönüştürür.
Unutmayın; en iyi sistem yöneticisi, en az kriz yaşayan ve en sessiz çalışan sistemlerin arkasındaki gizli güçtür.
Bu yazı Gemini ile otomatik oluşturulmuştur.