Terima kasih telah mengirimkan pertanyaan Anda! Salah satu anggota tim kami akan segera menghubungi Anda.
Terima kasih telah mengirimkan pemesanan Anda! Salah satu anggota tim kami akan segera menghubungi Anda.
Kerangka Materi
Pengenalan Awal mengenai AIOps
- Apa itu AIOps dan mengapa penting
- Perbandingan antara pemantauan konvensional dengan pendekatan observabilitas berbasis AIOps
- Arsitektur AIOps beserta komponen utamanya
Pengumpulan dan Penyatuan Data Operasional
- Jenis-jenis data observabilitas: metrik, log, serta jejak aktivitas
- Cara mengakses data dari berbagai sumber (server, kontainer, layanan cloud)
- Penggunaan agen dan alat ekspor seperti Prometheus, Beats, serta Fluentd
Korelasi Data dan Deteksi Anomali
- Teknik korelasi data waktu nyata serta metode statistik
- Penerapan model pembelajaran mesin untuk mengidentifikasi anomali
- Cara mendeteksi munculnya insiden di seluruh sistem terdistribusi
Pengaturan Pemberitahuan serta Pengurangan Gangguan Sinyal
- Merancang aturan pemberitahuan cerdas beserta ambang batasnya
- Cara menekan, menghindari duplikasi, dan mengelompokkan notifikasi
- Integrasi dengan sistem seperti Alertmanager, Slack, PagerDuty, atau Opsgenie
Analisis Akar Masalah serta Visualisasi Data
- Memanfaatkan panel kontrol untuk mengamati metrik dan pola perubahannya
- Menganalisis urutan kejadian untuk mencari penyebab utama masalah
- Melacak jejak kesalahan di berbagai lapisan aplikasi dengan alat tracing terdistribusi
Otomatisasi dan Penanggulangan Insiden
- Pengaktifan skrip atau alur kerja otomatis saat terjadi insiden
- Integrasi dengan sistem manajemen layanan IT (ITSM) seperti ServiceNow dan Jira
- Contoh aplikasinya: pengaturan kapasitas sendiri, pemindahan lalu lintas secara otomatis
Platform AIOps Open-Source dan Komersial
- Paparan singkat alat utama: Prometheus, Grafana, ELK, Moogsoft, Dynatrace
- Parameter yang harus dipertimbangkan saat memilih platform AIOps
- Demonstrasi langsung serta penerapan praktis menggunakan paket alat tertentu
Penutup dan Langkah Selanjutnya
Persyaratan
- Pemahaman mengenai konsep operasi TI serta pemantauan sistem
- Pengalaman menggunakan alat atau panel pemantauan
- Kenal dengan format log dan metrik dasar
Target Peserta
- Tim operasi yang mengelola infrastruktur maupun aplikasi
- Insinyur Keandalan Sistem (Site Reliability Engineers/SRE)
- Tim pemantauan dan observabilitas IT
14 Jam