Deskripsi Pekerjaan
Informasi lengkap tentang posisi dan persyaratan
Ringkasan Yukerja
Lowongan DevOps & SRE di PT HIKMAT UMAT BERINOVASI kami kurasi dari Glints (kategori Kesehatan). Perhatikan lokasi kerja (Pasar Minggu) sebelum melamar. Yukerja.com bukan pemberi kerja — lamaran diproses di situs sumber resmi.
PT HIKMAT UMAT BERINOVASI (HUB Studio) adalah perusahaan yang bergerak di bidang jasa perancangan solusi terintegrasi (integrated solution design), yang meliputi namun tidak terbatas pada analisis bisnis, pengembangan produk digital, serta desain dan aktivasi brand, dalam rangka mendukung transformasi dan optimalisasi di berbagai industri, termasuk Rumah Sakit dan layanan kesehatan.
Tujuan Jabatan :
Memastikan sistem dan infrastruktur teknologi HUB berjalan stabil, reliable, aman, dan scalable melalui pengelolaan infrastructure, deployment, monitoring, automation, incident management, dan continuous improvement.
Berperan dalam menjaga reliability production environment, mendukung kebutuhan IT Service Management (ITSM) dan Data Warehouse, serta berkolaborasi dengan tim Engineering, Product, Data, Operations, dan Development untuk memastikan sistem berjalan optimal dan kebutuhan teknologi perusahaan dapat terpenuhi dengan baik.
Kualifikasi (Wajib) :
- Minimal S1 Teknik Informatika, Sistem Informasi, Ilmu Komputer, atau bidang relevan.
- Memiliki pengalaman 3–5 tahun di bidang DevOps, Site Reliability Engineering (SRE), Infrastructure Engineering, System Engineering, atau posisi sejenis.
- Memahami Linux/Unix system administration, server management, networking, dan infrastructure management.
- Memahami CI/CD, deployment, monitoring, logging, alerting, serta praktik automation dalam pengelolaan sistem.
- Memiliki pengalaman menggunakan cloud infrastructure seperti Alibaba Cloud (Aliyun), AWS, GCP, Azure, atau platform sejenis.
- Memahami containerization seperti Docker dan memiliki pemahaman terhadap orchestration seperti Kubernetes.
- Mampu melakukan troubleshooting, incident handling, dan root cause analysis (RCA) secara sistematis.
- Memahami konsep system reliability, high availability, scalability, backup, dan disaster recovery.
- Memahami database dan mampu melakukan troubleshooting dari sisi infrastructure maupun application.
- Memiliki kemampuan scripting menggunakan Bash, Python, atau bahasa scripting lainnya.
- Mampu bekerja secara mandiri maupun berkolaborasi dengan tim Engineering, Product, Data, dan Operations.
- Memiliki strong sense of ownership dan terbiasa bekerja secara hands-on dalam menyelesaikan permasalahan teknis.
- Memiliki kemampuan menggunakan Infrastructure as Code (IaC) seperti Terraform, Ansible, atau tools sejenis.
- Memiliki kemampuan stakeholder management, komunikasi teknis, dan koordinasi lintas fungsi yang baik dengan tim internal maupun stakeholder di berbagai lokasi.
- Terbiasa bekerja dalam environment multi-site dan multi-stakeholder, serta mampu mengelola beberapa issue secara paralel berdasarkan prioritas dan tingkat urgensinya.
Tanggung Jawab Utama :
- Mengelola dan menjaga availability, reliability, performance, dan security sistem serta infrastruktur teknologi.
- Melakukan monitoring, troubleshooting, dan incident management untuk memastikan sistem tetap berjalan optimal.
- Melakukan root cause analysis (RCA) dan memastikan corrective action diterapkan untuk mencegah masalah yang sama terulang.
- Mengelola proses deployment, release, configuration, dan maintenance sistem secara aman dan terkontrol.
- Mengembangkan dan mengoptimalkan CI/CD pipeline serta automation untuk meningkatkan efisiensi proses engineering dan operasional.
- Membangun dan memelihara sistem monitoring, logging, alerting, dan observability untuk meningkatkan visibility terhadap kondisi sistem.
- Mendukung kebutuhan IT Service Management (ITSM), termasuk incident, problem, service request, dan change management.
- Mendukung kebutuhan infrastructure dan reliability untuk Data Warehouse (DWH), data pipeline, serta integrasi antar sistem.
- Memastikan mekanisme backup, recovery, disaster recovery, dan business continuity berjalan sesuai kebutuhan.
- Berkolaborasi dengan tim Development untuk mendukung kebutuhan environment, deployment, infrastructure, dan troubleshooting aplikasi.
- Melakukan evaluasi dan continuous improvement terhadap reliability, scalability, security, dan efficiency sistem.
- Menyusun serta menjaga dokumentasi teknis terkait infrastructure, deployment, monitoring, incident handling, dan operational procedures.
- Berkolaborasi lintas fungsi dengan tim Product, Engineering, Data, Business/Operations, serta stakeholder Rumah Sakit untuk memastikan kebutuhan teknis dan operasional berjalan dengan baik.
- Menjadi PIC teknis untuk kebutuhan infrastructure dan system reliability pada environment yang digunakan di berbagai lokasi/cabang.
- Menangani dan mengoordinasikan incident serta troubleshooting bersama PIC/stakeholder di cabang Rumah Sakit, termasuk melakukan triage, menentukan prioritas dan eskalasi, serta memastikan permasalahan ditindaklanjuti hingga selesai.
- Mendukung tim Development internal terkait environment, deployment, infrastructure, dan troubleshooting aplikasi ketika diperlukan.
✨ Bergabunglah bersama PT HIKMAT UMAT BERINOVASI (HUB Studio) dan ambil peran dalam membangun serta menjaga sistem teknologi yang reliable, scalable, dan terus berkembang. Anda akan mendapatkan kesempatan untuk mengerjakan real-world infrastructure challenges, membangun automation, meningkatkan system reliability, serta berkolaborasi langsung dengan berbagai tim teknologi dalam membangun produk digital yang berdampak.