نقشه و مسیریاب نشان
نقشه و مسیریاب نشان

مهندس ارشد Site Reliability (SRE)

مشهد
تمام وقت
شنبه تا چهارشنبه
-
-

این فرصت شغلی چقدر برای من مناسب است؟

51 تا 200 نفر
فناوری اطلاعات / نرم افزار و سخت افزار
1384
خصوصی
توضیحات بیشتر

شاخص های کلیدی از نظر کارفرما

5 سال سابقه کار در گروه شغلی مشابه
PostgreSql - متوسط
Redis - متوسط
RabbitMQ - متوسط
Docker - متوسط
Kubernetes - متوسط
Prometheus - متوسط
Ansible - متوسط
ترجیحا ساکن مشهد

شرح شغل و وظایف

شما به عنوان Senior SRE به تیم زیرساخت نشان در دفتر مشهد خواهید پیوست. در این نقش، پایداری، مقیاس‌پذیری و امنیت زیرساخت سرویسی را بر عهده خواهید داشت که روزانه میلیون‌ها کاربر به آن اتکا می‌کنند. طراحی سیستم‌های تاب‌آور، خودکارسازی فرایندها و ارتقای استانداردهای مهندسی از وظایف کلیدی شماست؛ کارهایی که مستقیم بر کیفیت تجربه کاربران، عملکرد پایدار سرویس‌ها و ماندگاری کسب‌وکار نشان اثر خواهند گذاشت.
بخشی از مسئولیت‌های شما به عنوان Senior SRE:
طراحی و بهینه‌سازی معماری زیرساخت: توسعه معماری‌های مقیاس‌پذیر، امن و پایدار با اتکا به متدولوژی‌های به‌روز ابری و تعیین استانداردهای فنی متناسب با مقیاس سرویس
توسعه اتوماسیون و فرایندهای DevOps: طراحی، استقرار و نگهداری CI/CD برای تضمین تحویل سریع، امن، خودکار و با قابلیت بازگشت (Rollback) آسان
مدیریت زیرساخت‌های کلان (Large-Scale): پیکربندی و خودکارسازی سرویس‌های حیاتی، دیتابیس‌ها و ابزارهای پیام‌رسان در محیط‌هایی با ترافیک بالا (High-Traffic / Mission-Critical)
طراحی و راهبری سیستم‌های Observability: استقرار و بهینه‌سازی پلتفرم‌های مانیتورینگ، متریک‌ها، لاگ و سیستم‌های هشداردهی (Alerting) به منظور شناسایی زودهنگام ریسک‌ها و کاهش زمان بازیابی (MTTR)
مدیریت پیشامدها و واکاوی ریشه‌ای: مشارکت در چرخه‌های On-Call، مدیریت بحران در زمان وقوع اختلال و راهبری جلسه‌های واکاوی خطاها (Root Cause Analysis & Postmortem)
هم‌افزایی و ارتقای تیم: همکاری نزدیک با تیم‌های توسعه نرم‌افزار و محصول در راستای پیاده‌سازی الگوهای تاب‌آوری، مربی‌گری (Mentorship) نیروهای جوان‌تر و گسترش فرهنگ دانش‌افزایی در سازمان
اگر این توانایی‌ها را داری مشتاقیم باهات آشنا بشیم و گفت‌وگو کنیم:
5 سال پیشینه کار حرفه‌ای و پیوسته در حوزه‌های SRE و DevOps
تجربه عملی و عمیق در نگهداری و مقیاس‌پذیری سیستم‌های بزرگ‌مقیاسِ تحت ترافیک بالا و نیازمند دسترسی‌پذیری همیشگی (High Availability)
توانایی واکاوی سیستماتیک، حل چالش‌های پیچیده زیرساختی و تصمیم‌گیری دقیق در شرایط فشار و بحران
مهارت مستندسازی فنی شفاف و تعامل موثر با تیم‌های توسعه و محصول
مسئولیت‌پذیری، دقت در کار با سیستم‌های حساس و توجه به جزئیات
Container Orchestration and Virtualization: Kubernetes, Docker
Networking and Ingress: Nginx, Envoy
Monitoring and Observability: Grafana Stack, Prometheus
Messaging: RabbitMQ
Databases: PostgreSQL, Redis
Infrastructure as Code and Configuration Management: Terraform, Ansible
CI/CD: GitLab CI/CD, ArgoCD
اگر توانایی‌های زیر رو هم داری، برای همکاری باهات مشتاق‌تریم:
تجربه راه‌اندازی یا مشارکت در پروژه‌های مدرن‌سازی زیرساخت یا مهاجرت از سیستم‌های Legacy
تجربه تعریف و پیاده‌سازی برنامه‌های بازیابی پس از فاجعه (Disaster Recovery)
تجربه یا مشارکت در پیاده‌سازی زیرساخت‌های IaaS و PaaS
تجربه کار در تیم‌های چابک و همکاری نزدیک با تیم‌های توسعه محصول

شرایط احراز شغل

جنسیت
تفاوتی ندارد
نرم افزارها
Docker| متوسط Kubernetes| متوسط Prometheus| متوسط Redis| متوسط RabbitMQ| متوسط PostgreSql| متوسط Ansible| متوسط

ثبت مشکل و تخلف آگهی

ارسال رزومه برای نقشه و مسیریاب نشان