استخدام کارشناس مانیتورینگ و عملیات
شرح موقعیت شغلی
ما در حال توسعه تیم مانیتورینگ و عملیات پروژههای Enterprise شرکت هستیم و به دنبال افرادی مسئولیتپذیر، دقیق و پیگیر هستیم که بتوانند وضعیت سرویسها، سرورها، زیرساختها و سامانههای عملیاتی مشتریان سازمانی را بهصورت مستمر پایش کنند.
این موقعیت برای افرادی مناسب است که با مفاهیم پایه شبکه، سرور، سرویسهای نرمافزاری و ابزارهای مانیتورینگ آشنا هستند و توانایی تحلیل اولیه رخدادها، ثبت دقیق گزارشها و پیگیری مشکلات تا مرحله حل را دارند.
شرح وظایف
این موقعیت برای افرادی مناسب است که با مفاهیم پایه شبکه، سرور، سرویسهای نرمافزاری و ابزارهای مانیتورینگ آشنا هستند و توانایی تحلیل اولیه رخدادها، ثبت دقیق گزارشها و پیگیری مشکلات تا مرحله حل را دارند.
شرح وظایف
- پایش مستمر وضعیت سرویسها، سرورها، لینکها، منابع سختافزاری و نرمافزاری پروژههای Enterprise
- کار با ابزارهای مانیتورینگ مانند Zabbix، PRTG، Grafana، Prometheus یا ابزارهای مشابه
- بررسی Alertها، Eventها و Logهای سیستمی و تشخیص اولیه سطح اهمیت رخدادها
- ثبت، پیگیری و بهروزرسانی Issueها و Incidentها در ابزارهایی مانند Jira یا سامانههای تیکتینگ
- اطلاعرسانی بهموقع رخدادها به تیمهای فنی، پشتیبانی، زیرساخت یا مدیر پروژه
- مانیتورینگ سرویسهای حیاتی مانند Database، Application Server، Web Server، SIP/VoIP Services، APIها و سرویسهای وابسته
- تهیه گزارشهای روزانه، هفتگی و موردی از وضعیت سرویسها، قطعیها، هشدارها و اقدامات انجامشده
- همکاری با تیمهای فنی برای تحلیل ریشهای مشکلات تکرارشونده
- کنترل وضعیت SLA، زمان پاسخگویی و زمان رفع رخدادها
- مستندسازی رخدادها، راهکارهای موقت، اقدامات اصلاحی و تجربیات عملیاتی
- بررسی اولیه ظرفیت منابع مانند CPU، RAM، Disk، Network و Storage
- مشارکت در بهبود داشبوردها، Thresholdها، Alertها و فرآیندهای مانیتورینگ
مهارتها و توانمندیهای مورد نیاز
- آشنایی مناسب با مفاهیم شبکه شامل IP، DNS، Gateway، Ping، Traceroute، Port، Firewall و Routing پایه
- آشنایی با سیستمعاملهای Linux و Windows Server در سطح کاربری و عیبیابی اولیه
- توانایی بررسی وضعیت سرویسها، Processها، Logها و منابع سیستمی
- آشنایی با ابزارهای مانیتورینگ مانند Zabbix، PRTG، Grafana، Prometheus، ELK یا ابزارهای مشابه
- آشنایی با مفاهیم Incident Management، SLA، Escalation و گزارشدهی عملیاتی
- توانایی کار با Jira، Service Desk، Redmine یا سامانههای مشابه مدیریت وظایف و تیکت
- دقت بالا در ثبت اطلاعات، پیگیری رخدادها و مستندسازی
- توانایی تحلیل اولیه خطاها و تشخیص اینکه مشکل مربوط به شبکه، سرور، دیتابیس، نرمافزار یا سرویس بیرونی است
- مسئولیتپذیری، نظم، روحیه پیگیری و توانایی کار تیمی
- آمادگی برای کار در محیطهای Enterprise و پروژههای حساس سازمانی
مزیت محسوب میشود
- تجربه کار در تیمهای NOC، SOC، پشتیبانی فنی، دیتاسنتر یا عملیات سامانههای سازمانی
- آشنایی با VoIP، SIP، Asterisk، Kamailio یا سامانههای مرکز تماس
- آشنایی با Databaseهایی مانند Oracle، MySQL یا SQL Server
- تجربه کار با Linux Command Line
- آشنایی با Docker، Kubernetes یا مفاهیم High Availability
- تجربه طراحی یا بهبود داشبوردهای مانیتورینگ
- آشنایی با ITIL، بهخصوص فرآیندهای Incident، Problem و Change Management
- توانایی تهیه گزارشهای مدیریتی و عملیاتی
مزیت محسوب میشود
- تجربه کار در تیمهای NOC، SOC، پشتیبانی فنی، دیتاسنتر یا عملیات سامانههای سازمانی
- آشنایی با VoIP، SIP، Asterisk، Kamailio یا سامانههای مرکز تماس
- آشنایی با Databaseهایی مانند Oracle، MySQL یا SQL Server
- تجربه کار با Linux Command Line
- آشنایی با Docker، Kubernetes یا مفاهیم High Availability
- تجربه طراحی یا بهبود داشبوردهای مانیتورینگ
- آشنایی با ITIL، بهخصوص فرآیندهای Incident، Problem و Change Management
- توانایی تهیه گزارشهای مدیریتی و عملیاتی
حداقل شرایط احراز
- حداقل 3 سال تجربه کاری مرتبط در حوزه مانیتورینگ، پشتیبانی فنی، شبکه، زیرساخت یا عملیات سامانههای نرمافزاری
- آشنایی عملی با حداقل یک ابزار مانیتورینگ مانند Zabbix، PRTG یا ابزارهای مشابه
- آشنایی با مفاهیم پایه شبکه و سرور
- توانایی کار با ابزارهای ثبت و پیگیری تیکت
- توانایی تهیه گزارشهای ساده و دقیق از رخدادها و وضعیت سرویسها
مهارتهای مورد نیاز
- مانیتورینگ
- عملیات
- Microsoft Office
حداقل سابقه کار
- سه تا شش سال
حقوق
- حقوق از ۳۵,۰۰۰,۰۰۰ تومان
جنسیت
- مهم نیست
وضعیت نظام وظیفه
- مهم نیست