Canlı Sistem Operasyonu
Sisteminiz canlıda ve başında kimse yok. İzlemeyi kurar, veritabanlarınızın bakımını üstlenir, bir şey bozulduğunda müdahale ederiz — siz ürününüze odaklanırsınız.
Bu sorunlar tanıdık geliyorsa
- Bir şeyin bozulduğunu müşteri arayınca öğreniyoruz.
- Veritabanı yavaşladı, neden yavaşladığını kimse söyleyemiyor.
- Yedek alınıyor ama bugüne kadar hiç geri dönüş denemesi yapmadık.
- Sunucunun diski doldu ve kimsenin haberi olmadı.
- Sistemi kuran ekip gitti; şimdi kimse bir şeye dokunmaya cesaret edemiyor.
Kapsam
İzleme ve alarm kurulumu
Prometheus ile metrik toplama, Grafana ile panolar, eşik tabanlı alarmlar. Bir şeyin bozulduğunu müşteriden önce siz öğrenirsiniz.
Veritabanı yönetimi
PostgreSQL ve MongoDB tarafında performans analizi, indeks düzenlemesi, yavaş sorgu takibi, replikasyon kurulumu ve sürüm yükseltmeleri.
Yedekleme ve geri dönüş
Yedekleme düzeninin kurulması ve — asıl önemlisi — geri dönüş prosedürünün yazılması ve tatbikatının yapılması. Denenmemiş yedek, yedek sayılmıyor.
Olay müdahalesi
Sorun anında devreye girip kök nedeni bulmak, sistemi ayağa kaldırmak ve olayın tekrarlanmaması için gereken düzeltmeyi uygulamak.
Kapasite planlama
Büyüme eğrinize göre kaynak ihtiyacının önceden çıkarılması. Disk, bellek ve bağlantı havuzlarının duvara toslamadan önce genişletilmesi.
Güncelleme ve yama yönetimi
İşletim sistemi, çalışma zamanı ve bağımlılık güncellemelerinin planlı biçimde uygulanması. Güvenlik yamalarının geri kalmaması.
Log yönetimi
Logların merkezi olarak toplanması, saklama sürelerinin belirlenmesi ve bir olay sonrası geriye dönük iz sürülebilir hale getirilmesi.
Çalıştırma prosedürleri
Sık karşılaşılan durumlar için yazılı müdahale adımları. Nöbetteki kişi ne yapacağını tahmin etmek zorunda kalmaz.
Kullandığımız teknolojiler
- Prometheus
- Grafana
- PostgreSQL
- MongoDB
- Redis
Nasıl çalışırız
Sürekli operasyon desteği
Aylık belirli bir kapasiteyle sistemlerinizin bakımını üstleniriz. İzleme, güncelleme, veritabanı bakımı ve müdahale dahil.
Sistem devralma
Kuran kişi ayrılmış, doküman yok. Mevcut kurulumun haritasını çıkarır, eksikleri tamamlar ve işletmeyi üstleniriz.
Sağlık taraması
Tek seferlik inceleme. İzleme, yedekleme, güvenlik ve performans açısından mevcut durumu raporlar, önceliklendirilmiş liste bırakırız.
Sıkça sorulan sorular
Mesai dışı müdahale sağlıyor musunuz?
Destek kapsamı sözleşmeyle belirleniyor. Kritik sistemler için mesai dışını da kapsayan çalışma modelleri sunuyoruz; hangi seviyede müdahale gerektiğini ve yanıt süresini ilk görüşmede sizin gerçek ihtiyacınıza göre netleştiriyoruz. Karşılayamayacağımız bir taahhüdü sözleşmeye yazmıyoruz.
Sistemimizi hiç görmeden nasıl devralırsınız?
Devralma her zaman bir keşif aşamasıyla başlıyor: mevcut sunucular, servisler, bağımlılıklar ve erişim yolları çıkarılıyor. Bu aşamanın sonunda elimizde sistemin haritası ve risk listesi oluyor. Operasyonu ancak bundan sonra üstleniyoruz.
Hangi veritabanlarıyla çalışıyorsunuz?
Ağırlıklı olarak PostgreSQL ve MongoDB. Redis’i önbellek ve kuyruk katmanı olarak yaygın kullanıyoruz. Farklı bir veritabanı kullanıyorsanız ilk görüşmede açıkça söylüyoruz — deneyimimiz olmayan bir sistemi varmış gibi göstermiyoruz.
Mevcut izleme kurulumumuz var, onu kullanabilir misiniz?
Evet. Çalışan bir Prometheus/Grafana kurulumunuz varsa üzerine inşa ediyoruz. Farklı bir araç kullanıyorsanız onunla da çalışırız; her şeyi değiştirmek nadiren doğru hamle oluyor.
Kendi ekibimiz varken neden dışarıdan destek alalım?
Çoğu ekipte operasyon, asıl işin yanında ikinci öncelik olarak kalıyor — ta ki bir şey bozulana kadar. Biz bu kısmı üstlenerek ekibinizin ürün geliştirmeye odaklanmasını sağlıyoruz. İsterseniz ekibinizi eğitip işi kademeli olarak geri devrediyoruz.
İlgili hizmetler
Ne kurmaya çalıştığınızı anlatın.
İlk görüşme teknik geçer, satış sunumu yapmayız. Mevcut durumunuzu dinler, yapılabilir olup olmadığını söyleriz. 2 iş günü içinde dönüş yaparız.