Hubungi Kami

Kerangka Materi

Pengenalan Awal mengenai AIOps

  • Apa itu AIOps dan mengapa penting
  • Perbandingan antara pemantauan konvensional dengan pendekatan observabilitas berbasis AIOps
  • Arsitektur AIOps beserta komponen utamanya

Pengumpulan dan Penyatuan Data Operasional

  • Jenis-jenis data observabilitas: metrik, log, serta jejak aktivitas
  • Cara mengakses data dari berbagai sumber (server, kontainer, layanan cloud)
  • Penggunaan agen dan alat ekspor seperti Prometheus, Beats, serta Fluentd

Korelasi Data dan Deteksi Anomali

  • Teknik korelasi data waktu nyata serta metode statistik
  • Penerapan model pembelajaran mesin untuk mengidentifikasi anomali
  • Cara mendeteksi munculnya insiden di seluruh sistem terdistribusi

Pengaturan Pemberitahuan serta Pengurangan Gangguan Sinyal

  • Merancang aturan pemberitahuan cerdas beserta ambang batasnya
  • Cara menekan, menghindari duplikasi, dan mengelompokkan notifikasi
  • Integrasi dengan sistem seperti Alertmanager, Slack, PagerDuty, atau Opsgenie

Analisis Akar Masalah serta Visualisasi Data

  • Memanfaatkan panel kontrol untuk mengamati metrik dan pola perubahannya
  • Menganalisis urutan kejadian untuk mencari penyebab utama masalah
  • Melacak jejak kesalahan di berbagai lapisan aplikasi dengan alat tracing terdistribusi

Otomatisasi dan Penanggulangan Insiden

  • Pengaktifan skrip atau alur kerja otomatis saat terjadi insiden
  • Integrasi dengan sistem manajemen layanan IT (ITSM) seperti ServiceNow dan Jira
  • Contoh aplikasinya: pengaturan kapasitas sendiri, pemindahan lalu lintas secara otomatis

Platform AIOps Open-Source dan Komersial

  • Paparan singkat alat utama: Prometheus, Grafana, ELK, Moogsoft, Dynatrace
  • Parameter yang harus dipertimbangkan saat memilih platform AIOps
  • Demonstrasi langsung serta penerapan praktis menggunakan paket alat tertentu

Penutup dan Langkah Selanjutnya

Persyaratan

  • Pemahaman mengenai konsep operasi TI serta pemantauan sistem
  • Pengalaman menggunakan alat atau panel pemantauan
  • Kenal dengan format log dan metrik dasar

Target Peserta

  • Tim operasi yang mengelola infrastruktur maupun aplikasi
  • Insinyur Keandalan Sistem (Site Reliability Engineers/SRE)
  • Tim pemantauan dan observabilitas IT
 14 Jam

Jumlah Peserta


Harga per Peserta

Kursus Mendatang

Kategori Terkait