Service Reliability Engineering (SRE)

Service Reliability Engineering (SRE)

Service Reliability Engineering (SRE)

30 June - 1 July 2026 Jakarta Hotel Asyana Kemayoran

Deskripsi

Dalam era layanan perbankan digital yang semakin bergantung pada sistem teknologi yang kompleks, keandalan (reliability), ketersediaan (availability), dan kinerja layanan menjadi faktor kritikal yang secara langsung memengaruhi pengalaman nasabah, reputasi institusi, serta kepatuhan terhadap standar regulasi. Gangguan sistem, downtime aplikasi, keterlambatan transaksi, atau kegagalan infrastruktur tidak hanya berdampak pada aspek operasional, tetapi juga dapat menimbulkan risiko finansial, reputasi, dan kepatuhan yang signifikan. Oleh karena itu, pendekatan tradisional dalam pengelolaan operasional IT tidak lagi memadai untuk menjawab kebutuhan bisnis yang menuntut layanan cepat, stabil, dan selalu tersedia. Service Reliability Engineering (SRE) hadir sebagai pendekatan modern yang menggabungkan prinsip rekayasa perangkat lunak dengan praktik operasional untuk memastikan sistem tetap andal, terukur, dan dapat ditingkatkan secara berkelanjutan.

Pelatihan ini dirancang untuk memberikan pemahaman komprehensif mengenai konsep, prinsip, dan praktik terbaik SRE dalam konteks industri perbankan. Peserta akan mempelajari bagaimana mengelola layanan berbasis service level objectives (SLOs), service level indicators (SLIs), serta error budgets sebagai dasar pengambilan keputusan operasional dan bisnis. Selain itu, pelatihan ini juga membahas automasi operasional, observability, incident management, capacity planning, serta integrasi SRE dengan DevOps dan cloud-native architecture. Dengan pendekatan berbasis studi kasus dan simulasi, peserta diharapkan mampu meningkatkan ketahanan layanan digital, mengurangi insiden operasional, mempercepat pemulihan gangguan, serta membangun sistem IT yang lebih scalable, resilient, dan aligned dengan kebutuhan bisnis perbankan modern.

Tujuan

Setelah mengikuti pelatihan ini, peserta diharapkan mampu:

  • Memahami konsep dasar Service Reliability Engineering (SRE) dan perbedaannya dengan tradisional IT operations. 
  • Mengidentifikasi indikator kinerja layanan seperti SLI, SLO, dan SLA dalam konteks layanan perbankan. 
  • Menerapkan prinsip error budget dalam pengelolaan layanan digital. 
  • Mengembangkan strategi incident management dan problem resolution yang efektif. 
  • Mengimplementasikan observability (logging, metrics, tracing) untuk meningkatkan visibilitas sistem. 
  • Mengintegrasikan praktik SRE dengan DevOps, cloud computing, dan strategi transformasi digital perbankan.

Materi

Materi 1. Fundamental Service Reliability Engineering (SRE)

Sub Materi:

  • Konsep dasar SRE dan sejarah perkembangannya 
  • Perbedaan SRE, DevOps, dan traditional IT operations 
  • Prinsip utama reliability engineering 
  • Tantangan reliability di industri perbankan digital 
  • Peran SRE dalam digital banking ecosystem 
  • Studi kasus kegagalan sistem dan dampaknya 

Materi 2. Service Level Objectives (SLO), Service Level Indicators (SLI), dan SLA

Sub Materi:

  • Definisi SLI, SLO, dan SLA 
  • Cara menentukan indikator layanan yang relevan 
  • Pengukuran availability, latency, dan throughput 
  • Hubungan SLO dengan customer experience 
  • Penetapan target layanan di industri perbankan 
  • Monitoring dan evaluasi kinerja layanan 

Materi 3. Error Budget dan Reliability Management

Sub Materi:

  • Konsep error budget dan fungsinya dalam SRE 
  • Trade-off antara inovasi dan stabilitas 
  • Penggunaan error budget dalam decision making 
  • Strategi ketika error budget habis 
  • Policy enforcement berbasis reliability 
  • Studi kasus implementasi error budget 

Materi 4. Incident Management dan Postmortem Analysis

Sub Materi:

  • Incident lifecycle management 
  • Klasifikasi severity incident 
  • Proses escalation dan komunikasi insiden 
  • Root cause analysis (RCA) 
  • Blameless postmortem culture 
  • Continuous improvement dari insiden 

Materi 5. Observability dan Monitoring Sistem

Sub Materi:

  • Konsep observability vs monitoring 
  • Metrics, logs, dan distributed tracing 
  • Tools observability modern 
  • Real-time monitoring infrastruktur perbankan 
  • Alerting system dan noise reduction 
  • Dashboard operasional untuk SRE 

Materi 6. Workshop Implementasi SRE untuk Layanan Perbankan

Sub Materi:

  • Studi kasus downtime layanan digital banking 
  • Penyusunan SLI dan SLO untuk layanan kritikal 
  • Simulasi incident response 
  • Analisis error budget pada layanan nyata 
  • Penyusunan framework SRE organisasi 
  • Roadmap implementasi SRE di lingkungan perbankan

Peserta

  • Teknologi Informasi (TI)
  • IT Operations
  • Site Reliability Engineering (SRE)
  • Infrastruktur TI
  • DevOps
  • Digital Banking
  • Keamanan Informasi (Information Security)

Metode

  • Pre-test
  • Presentasi Materi
  • Diskusi
  • Studi Kasus
  • Post-test

Fasilitas

  • Training Amenities
  • Peralatan Pelatihan (Tas, Hand Out, Flashdisk, Block Note, Pulpen, Watermark)
  • Sertifikat 
  • Souvenir
  • 2x Coffee Break, 1x Lunch
Kembali ke Layanan