توضیحات
شرح شغل:
نظارت، مانیتورینگ و گزارشدهی (شبکه و سرویسهای زیرساختی) از طریق نرمافزارها و داشبوردهای مانیتورینگ
پاسخگویی به هشدارها و رخدادها بر اساس دستورالعملهای از پیش تعیینشده
پیگیری و مشارکت فعال در فرآیند تشخیص و رفع خطا
مستندسازی وقایع و نگارش گزارش
ویژگیها و مهارتهای موردنیاز:
آشنایی و درک مناسب از مفاهیم، لایهها، پروتکلها و تجهیزات شبکه
آشنایی و درک مناسب از مفاهیم نرمافزار و پایگاهداده
آشنایی با نرمافزارهای مانیتورینگ و مدیریت لاگ از جمله ELK، Grafana، Prometheus و ...
آشنایی و درک مناسب از پایش و وابستگی بین سرویسها
آشنایی و مهارت در عملیاتهای مرتبط با پایداری سرویس
آشنایی با Docker، Kubernetes و SRE
توانایی توسعه سامانههای مانیتورینگ
توانایی تشخیص و آنالیز رخدادها و مشکلات
ویژگیهای فردی:
دقت بالا و توجه به جزئیات
متعهد، مسئولیتپذیر و علاقهمند به یادگیری
تفکر سیستمی، تحلیل و حل مسئله
توانایی کار در شیفت چرخشی به صورت 12-24
توانایی کار به صورت مستقل و همکاری موثر تیمی
* سابقه کار در سازمانهایی با زیرساخت حیاتی یا SLA حساس مزیت محسوب میشود.