Skill diminta
AWSAzureCI/CDDatadogDockerGCPGitHub ActionsGitLab CIGrafanaJenkinsKubernetesMySQLPostgreSQLPrometheusPythonTroubleshooting
Deskripsi
- Kami mencari seorang
- DevOps Engineer
yang berpengalaman untuk membangun, mengelola, dan mengoptimalkan infrastruktur cloud kami. Memiliki engalaman sebagai QA Engineer / Backend Engineer / Frontend Engineer (sebagai nilai tambah). Kandidat ideal memiliki pemahaman kuat tentang automasi, container orchestration, monitoring, dan keamanan sistem — serta mampu merespons cepat saat terjadi insiden produksi.
Tanggung Jawab
Merancang dan mengelola infrastruktur cloud yang scalable untuk aplikasi dengan beban lalu lintas fluktuatif, termasuk auto-scaling dan load balancing.
- Membangun dan memelihara pipeline CI/CD yang aman dan andal, termasuk manajemen secrets.
- Melakukan diagnosis dan troubleshooting saat terjadi peningkatan latensi atau gangguan pada server produksi.
- Menentukan dan memantau key metrics sistem menggunakan tools monitoring (Grafana/Datadog).
- Menulis skrip automasi (Bash/Python) untuk monitoring server, maintenance berkala, dan alerting.
- Mengelola cluster Kubernetes: namespace, Horizontal Pod Autoscaler (HPA), serta mendiagnosis dan memperbaiki pod yang crash/tidak stabil.
- Mengatur dan memelihara VPN server (OpenVPN/Pritunl) termasuk manajemen akses user dan keamanan.
- Mengimplementasikan strategi backup dan disaster recovery database (PostgreSQL/MySQL) tanpa mengganggu performa produksi.
- Menyusun dan menjalankan mitigation plan untuk mencegah downtime deployment dan menangani insiden keamanan (termasuk DDoS).
Kualifikasi
- Pengalaman minimal 2–3 tahun sebagai DevOps Engineer, SRE, atau System Administrator.
- Familiar dengan cloud infrastructure (
- AWS — lebih disukai
- /GCP/Azure), containerization (Docker), dan orchestration (Kubernetes).
- Memahami prinsip CI/CD dan pernah membangun pipeline (misal: GitHub Actions, GitLab CI, Jenkins).
- Menguasai scripting (Bash dan/atau Python) untuk automasi.
- Berpengalaman dengan tools monitoring (Grafana, Datadog, Prometheus, atau setara).
- Memahami dasar-dasar keamanan sistem, jaringan, dan VPN (OpenVPN/Pritunl).
- Berpengalaman menangani backup & recovery database (PostgreSQL/MySQL).
- Mampu bekerja di bawah tekanan saat insiden produksi terjadi, dengan pendekatan yang terstruktur dan tenang.
- Work Arrangement
Full-Time
- Diutamakan kandidat yang bersedia bekerja
- on-site/WFO
Freelance
- Posisi dapat dilakukan secara
- remote/WFH
- , dengan tetap mengikuti kebutuhan dan koordinasi project.
Catatan
- Kandidat yang bersedia bekerja on-site akan menjadi prioritas utama untuk posisi full-time.
- Nilai Tambah
- Pengalaman menyusun dokumentasi teknis dan mitigation plan.
- Pernah menangani insiden keamanan (server compromised, DDoS, dll).
- Sertifikasi cloud (
- AWS lebih disukai
- , atau GCP/Azure) atau Kubernetes (CKA).
Kandidat yang lolos seleksi awal akan diminta mengerjakan technical test yang mencakup studi kasus infrastruktur, CI/CD, Kubernetes, monitoring, keamanan, dan skenario insiden produksi.