راهکار های ابری آبالون
راهکار های ابری آبالون

Cloud Operations Engineer – Tier 2

تهران، سهروردی
تمام وقت
شنبه تا چهارشنبه 8:00 تا 17:00
0
وام -بیمه درمان تکمیلی -ناهار -امکانات ورزشی -صبحانه -بسته ها و هدایای مناسبتی
51 تا 200 نفر
فناوری اطلاعات / نرم افزار و سخت افزار
شرکت ایرانی دارای مشتریان داخلی و خارجی
1394
راهکارهای ابری آبالون
خصوصی
توضیحات بیشتر

شاخص های کلیدی از نظر کارفرما

5 سال سابقه کار در گروه شغلی مشابه
Python - مقدماتی
Linux - متوسط
Docker - مقدماتی
Prometheus - مقدماتی
Gerafana - مقدماتی
زبان انگلیسی-بالاتر از متوسط

شرح شغل و وظایف

1) درباره ما
آبالون کلاد (Abalon Cloud) یک ارائه‌دهنده خدمات ابری عمومی، اختصاصی و ترکیبی (Private, Public & Hybrid) مبتنی بر OpenStack و Kubernetes است که با هدف توسعه زیرساخت ابری پایدار، امن و بومی در ایران فعالیت می‌کند. ما به دنبال ساخت فرهنگی هستیم که در آن مهندسان، مدیران و متخصصان با تکیه بر خلاقیت، شفافیت و مسئولیت‌پذیری، آینده فناوری ابری کشور را رقم بزنند.
 
2) درباره‌ی موقعیت شغلی
به‌دنبال فردی توانمند، تحلیل‌گر و مسئولیت‌پذیر هستیم تا با عنوان Cloud Operations Engineer – Tier 2 به تیم عملیات آبالون بپیوندد. در این نقش، شما مسئول تحلیل، مدیریت و پایدارسازی رخدادهای پیچیده در زیرساخت ابری خواهید بود. انتظار می‌رود علاوه بر درک عمیق رفتار سرویس‌ها و معماری Cloud، بتوانید در شرایط بحرانی تصمیم‌گیری کنید، تیم Tier1 را راهنمایی نمایید و با همکاری نزدیک با تیم‌های Cloud_Engineering، Platform_Engineering و Infrastructure مشکلات را تا رسیدن به Root Cause واقعی دنبال کنید.
این جایگاه صرفاً ادامه مسیر Tier1 نیست؛ بلکه نقطه ورود به مهندسی عملیات ابری (Cloud Operations Engineering) است و برای افرادی طراحی شده که علاوه بر دانش فنی، توانایی تحلیل سیستم، تصمیم‌گیری و هدایت عملیات را نیز در خود توسعه داده‌اند.
 
3) مهارت‌ها و شایستگی‌ها
مهارت‌های فنی (Technical):
  • تسلط بر Linux و سیستم‌های مبتنی بر Unix در سطح عملیاتی و Troubleshooting
  • درک عمیق از Networking در محیط‌های Cloud شامل TCP/IP، Routing، DNS، Load Balancing و Troubleshooting ارتباطات
  • درک معماری Cloud Computing و تجربه عملی با OpenStack و سرویس‌های اصلی آن (Nova، Neutron، Keystone، Cinder، Glance و ...)
  • آشنایی عملی با معماری سیستم‌های ذخیره‌سازی توزیع‌شده (ترجیحاً Ceph)
  • تسلط بر مفاهیم Monitoring، Logging، Alerting و Observability و تجربه کار با ابزارهایی مانند Prometheus، Grafana، ELK_OpenSearch و مشابه آن‌ها
  • توانایی تحلیل Logها، Metricها و Eventهای سیستم
  • آشنایی با مفاهیم Virtualization، Containerization و Distributed Systems
  • آشنایی با Scripting و Automation (Bash یا Python)
  • توانایی تحلیل و مدیریت Incidentهای پیچیده و تهیه گزارش‌های RCA و RFO
  • آشنایی با فرآیندهای Incident، Problem و Change Management مبتنی بر ITIL
  • توانایی تحلیل داده‌های عملیاتی و استفاده از KPIها در تصمیم‌گیری و بهبود مستمر
شایستگی‌های فردی (Soft Skills):
  • توانایی حفظ آرامش و تصمیم‌گیری در شرایط بحرانی
  • قدرت تحلیل، تفکر سیستمی و حل مسئله
  • مسئولیت‌پذیری بالا و احساس Ownership نسبت به سرویس‌ها
  • توانایی انتقال دانش به Tier1
  • مهارت مستندسازی دقیق و شفاف
  • توانایی همکاری موثر با تیم‌های چندتخصصی
  • روحیه یادگیری مستمر و Continuous Improvement
  • صداقت، شفافیت و پایبندی به اصول حرفه‌ای (Professional Integrity)
 
4) انتظارات و مسئولیت‌ها
  • تحلیل، مدیریت و پایدارسازی رخدادهای پیچیده در محیط Production
  • هدایت Incidentهای Sev-2 و مشارکت فعال در مدیریت Incidentهای Sev-1
  • تحلیل رفتار سرویس‌های Cloud و شناسایی Root Cause رخدادها
  • اجرای اقدامات اصلاحی در سطح سرویس، Cluster و زیرساخت بر اساس Runbookها و تجربه مهندسی
  • همکاری نزدیک با تیم‌های Cloud_Engineering، Platform_Engineering و Infrastructure در حل مسائل چندلایه
  • پشتیبانی فنی Tier1 در تحلیل و مدیریت رخدادها
  • توسعه، بازنگری و بهبود Runbookها، SOPها و فرآیندهای عملیاتی
  • تهیه مستندات فنی، Root Cause Analysis (RCA) و Reason for Outage (RFO)
  • مشارکت در بهبود Monitoring، Alerting، Observability و کاهش Alert Fatigue (خستگی ناشی از اَلِرت زیاد)
  • مشارکت در Incident Review، Postmortem و Continuous Improvement
  • شناسایی مشکلات تکرارشونده و ارائه پیشنهادهای فنی برای افزایش قابلیت اطمینان سرویس‌ها
 
5) آنچه از شما انتظار داریم
در آبالون، از یک Cloud Operations Engineer – Tier2 انتظار نمی‌رود صرفاً مشکلات را برطرف کند؛ بلکه انتظار می‌رود علت وقوع آن‌ها را درک کرده، از تکرارشان جلوگیری کند و به افزایش قابلیت اطمینان سرویس‌های ابری کمک نماید. ما به‌دنبال مهندسی هستیم که بتواند میان جزئیات فنی و تصویر کلی سیستم ارتباط برقرار کند، در شرایط عدم قطعیت تصمیم‌های منطقی بگیرد و در کنار حل مسائل روزمره، در بهبود مستمر فرآیندها، مستندات و کیفیت عملیات نقش فعال داشته باشد.
انتظار داریم علاوه بر توسعه مهارت‌های فنی خود، در رشد اعضای Tier1 نیز مشارکت کنید و دانش و تجربه خود را از طریق آموزش، مستندسازی و بازخوردهای سازنده به تیم منتقل نمایید.
برای ما، موفقیت یک مهندس Tier2 تنها با تعداد Incidentهای حل‌شده سنجیده نمی‌شود؛ بلکه با کیفیت تصمیم‌هایی که می‌گیرد، میزان اعتمادی که در تیم ایجاد می‌کند و اثری که بر پایداری بلندمدت سرویس‌ها می‌گذارد، معنا پیدا می‌کند.
 
6) شرایط کار
  • نوع همکاری: تمام‌وقت
  • محل فعالیت: دفتر مرکزی آبالون کلاد (تهران)
  • نوبت‌کاری: حضوری به همراه حضور در برنامه On-Call به طور گردشی و بر اساس نیازهای عملیاتی در زمان بحران
  • گزارش‌دهی مستقیم به: Cloud Operations Manager

شرایط احراز شغل

جنسیت
تفاوتی ندارد
خدمت سربازی
اتمام خدمت سربازی و یا معافیت از آن الزامی است
زبان
انگلیسی| بالاتر از متوسط ۷۰٪
نرم افزارها
Linux| متوسط Docker| مقدماتی Python| مقدماتی Prometheus| مقدماتی Gerafana| مقدماتی

ثبت مشکل و تخلف آگهی

ارسال رزومه برای راهکار های ابری آبالون

insight applicant

مقایسه من با سایر متقاضیان