Jasa Monitoring Server 24 Jam
Pemeriksaan dari luar jaringan dengan notifikasi ke kanal tim Anda.
Jasa monitoring server 24 jam memeriksa layanan dari luar jaringan dan mengirim notifikasi ke kanal tim saat kondisi perlu ditindaklanjuti. Ambang batas disetel berdasarkan pola layanan Anda agar peringatan tetap relevan, bukan sekadar ramai.
Pemantauan yang berguna dan pemantauan yang berisik dibedakan satu hal: berapa persen notifikasi yang benar-benar dikerjakan. Sistem yang mengirim lima puluh pesan sehari akan diabaikan dalam dua minggu, dan setelah itu ia tidak melindungi apa pun.
Yang kami bangun sengaja pelit. Sedikit peringatan, semuanya berarti sesuatu.
Diperiksa dari luar, bukan dari dalam server
Pemantauan yang hanya berjalan di dalam server punya kelemahan mendasar: ketika servernya mati, yang memantau juga mati. Karena itu pemeriksaan utama kami dilakukan dari luar jaringan Anda.
Monitoring uptime website dari beberapa lokasi juga membedakan dua hal yang gejalanya mirip: situs benar-benar mati, atau hanya tidak terjangkau dari satu jalur jaringan tertentu. Perbedaan itu menentukan siapa yang harus dihubungi — tim Anda atau penyedia jaringan.
Yang diperiksa dari luar bukan hanya apakah port terbuka. Kami memeriksa apakah halaman benar-benar memuat konten yang diharapkan, karena server yang menyala tapi mengembalikan `502 Bad Gateway` tetap berarti layanan mati bagi pengunjung.

Pasang Zabbix untuk metrik di dalam server
Pemeriksaan dari luar menjawab "apakah layanan hidup". Untuk menjawab "kenapa" dan "kapan akan bermasalah", diperlukan metrik dari dalam — dan di situlah kami pasang Zabbix.
Zabbix mengumpulkan pemakaian CPU, memori, disk, jaringan, serta metrik spesifik layanan seperti jumlah koneksi MySQL, panjang antrean, dan laju kesalahan. Datanya disimpan berbulan-bulan, sehingga pertanyaan "apakah ini normal" bisa dijawab dengan membandingkan periode yang sama tahun lalu.
Nilai terbesarnya justru pada tren, bukan pada nilai saat ini. Disk yang tumbuh 2 GB per hari akan penuh dalam waktu yang bisa dihitung, dan pemberitahuannya bisa keluar tiga minggu sebelum menjadi masalah.
Grafana dashboard server untuk melihat pola
Data yang terkumpul menjadi berguna kalau bisa dilihat dengan cepat. Grafana dashboard server yang kami siapkan menampilkan metrik penting dalam satu layar, dengan skala waktu yang bisa digeser saat menelusuri gangguan.
Susunan dasbornya kami bedakan per pembaca. Satu dasbor ringkas untuk manajemen — ketersediaan layanan dan tren beban bulanan. Satu dasbor rinci untuk tim teknis, di mana grafik disusun berdampingan supaya korelasi antar-metrik terlihat.
Korelasi itu yang biasanya menyelesaikan pertanyaan sulit. Lonjakan waktu respons yang berbarengan dengan naiknya operasi tulis disk dan panjang antrean basis data menunjuk ke satu arah dengan cukup jelas.
Notifikasi Telegram server dan kanal lainnya
Notifikasi Telegram server adalah pilihan yang paling sering diminta, dan alasannya praktis: semua orang sudah memasangnya, pesan masuk seketika, dan grup bisa berisi tim Anda beserta tim kami sekaligus.
Kanal lain juga tersedia dan sering dipakai bersamaan, dengan pembagian berdasarkan tingkat kegentingannya.
- Telegram atau WhatsApp untuk peringatan yang butuh perhatian segera.
- Email untuk hal yang bisa dibaca pada jam kerja, seperti sertifikat menjelang kedaluwarsa.
- Slack atau Microsoft Teams bila tim Anda memang bekerja di sana.
- Panggilan telepon untuk gangguan yang menghentikan layanan di luar jam kerja.
Alerting server: menyetel ambang supaya tidak berisik
Penyetelan alerting server adalah bagian yang paling menentukan, dan yang paling sering dilewatkan. Ambang bawaan hampir selalu terlalu sensitif: CPU 80 persen selama satu menit itu normal pada banyak beban kerja, bukan keadaan darurat.
Yang kami pakai adalah kondisi yang bertahan. CPU tinggi selama lima belas menit berarti sesuatu; lonjakan tiga puluh detik tidak. Disk penuh dinilai dari tren pertumbuhannya, bukan dari satu angka persentase.
Peringatan juga dikelompokkan supaya satu masalah tidak menghasilkan dua puluh pesan. Ketika server mati, yang keluar satu pemberitahuan tentang server itu — bukan satu pesan untuk setiap layanan di dalamnya.
Setelah berjalan sebulan, ambangnya ditinjau ulang berdasarkan data nyata. Peringatan yang ternyata tidak pernah butuh tindakan dinaikkan ambangnya atau dimatikan, dan itu bagian dari pekerjaan — bukan tanda pemasangannya gagal.
Menghubungkan pemantauan ke keputusan kapasitas
Nilai pemantauan yang paling sering tidak dimanfaatkan adalah perannya dalam perencanaan. Data enam bulan menjawab pertanyaan yang selama ini dijawab dengan tebakan: apakah server ini perlu ditambah kapasitasnya sebelum akhir tahun, dan berapa.
Setiap tinjauan kuartalan kami sertakan grafik tren beban puncak dan pemakaian disk, beserta proyeksi kapan batasnya akan tersentuh. Keputusan menambah kapasitas jadi punya dasar angka, bukan didorong oleh satu insiden yang baru terjadi.
Cara yang sama juga berguna ke arah sebaliknya. Server yang enam bulan tidak pernah melewati sepertiga kapasitasnya adalah kandidat penghematan, dan kami sebutkan itu — termasuk ketika artinya tagihan Anda ke penyedia infrastruktur bisa turun. Daftar teknologi pemantauan yang kami pakai bisa dilihat di halaman teknologi.
Lainnya seputar Manage Server
Pertanyaan seputar Monitoring Server
Apakah pemantauan berarti gangguan langsung ditangani?
Pemantauan menghasilkan pemberitahuan; penanganannya cakupan terpisah. Banyak pelanggan mengambil keduanya, tetapi ada juga yang hanya ingin diberi tahu dan menangani sendiri.
Berapa lama data metriknya disimpan?
Secara bawaan kami simpan setahun untuk data ringkasan dan tiga bulan untuk data rinci. Itu cukup untuk membandingkan periode musiman, dan bisa diperpanjang bila ada kebutuhan audit.
Apakah agen pemantauan membebani server?
Agen Zabbix sangat ringan — pemakaian sumber dayanya biasanya tidak terlihat pada grafik. Yang perlu diperhatikan justru frekuensi pengambilan data yang terlalu sering pada metrik yang mahal dihitung.
Bisa memantau server yang bukan kami kelola?
Bisa, dan cukup sering diambil terpisah. Pemeriksaan dari luar tidak menuntut akses apa pun; untuk metrik dari dalam, hanya perlu memasang satu agen.
Siapa yang menerima notifikasi?
Daftar penerimanya Anda tentukan, dan bisa berbeda per tingkat kegentingan. Umumnya tim Anda dan tim kami menerima yang sama, supaya tidak ada yang menunggu pihak lain bertindak.
Server jalan, tapi tidak ada yang benar-benar memegang?
Itu kondisi paling umum yang kami temui. Ceritakan jumlah server dan aplikasinya, kami susun cakupan yang masuk akal.