ابرپردازش شریف به دنبال یک کارشناس ارشد SRE است که علاوه بر مسئولیت پایداری و قابلیت اطمینان سرویسها، در طراحی زیرساخت و معماری پروژهها نیز از منظر Availability و Reliability نقش موثری داشته باشد. اگر به طراحی سیستمهای پایدار و مقیاسپذیر، Observability، اتوماسیون و حل مسائل پیچیده زیرساختی علاقهمند هستید، خوشحال میشویم با شما آشنا شویم. مسئولیتهای اصلی
طراحی و بهبود زیرساخت پروژهها با تمرکز بر Availability، Reliability، Scalability و شناسایی نقاط شکست و Single Point of Failure
مشارکت در طراحی SLA، SLO و SLI و تعریف معیارهای قابلاندازهگیری برای پایداری سرویسها
ارائه نظر تخصصی در طراحی معماری و محصول از منظر Reliability و Availability و بررسی ریسکهای عملیاتی تصمیمهای فنی
طراحی و توسعه Observability شامل Monitoring، Logging، Tracing و Alerting با استفاده از ابزارهایی مانند Prometheus، Grafana، ELK و OpenTelemetry
مدیریت و بهبود زیرساختهای Kubernetes و اکوسیستم آن و زیرساختهای مورد نیاز سرویسهای Production
توسعه و نگهداری CI/CD و Infrastructure as Code با هدف استقرار امن، پایدار و قابل تکرار
مدیریت Incidentها و On-call، تحلیل ریشهای رخدادها و پیگیری اقدامات اصلاحی و Postmortem
شناسایی و حذف Toil و بهبود مستمر فرآیندها، ابزارها و معماری زیرساخت
ویژگیهایی که برای ما مهم است:
حداقل 3 سال تجربه مرتبط در حوزه SRE، DevOps، زیرساخت یا حوزههای مشابه
توانایی تحلیل و حل مسائل پیچیده
تفکر سیستمی و دید End-to-End نسبت به سرویسها
توانایی تصمیمگیری بر اساس داده و سنجش ریسک
مسئولیتپذیری و پیگیری مسئله تا رسیدن به نتیجه
توانایی حفظ آرامش و تصمیمگیری در شرایط بحرانی
ارتباط موثر و توانایی همکاری با تیمهای مختلف
دقت و توجه به جزئیات
انعطافپذیری و انطباقپذیری
علاقهمندی به اتوماسیون و حذف کارهای تکراری
پایبندی به فرهنگ Blameless و یادگیری از خطاها
درباره شرکتشرکت ابرپردازش شریف با ارائه زیرساختهای قدرتمند و خدمات تخصصی، به مشتریان کمک میکند تا چالشهای پیچیده را در حوزههای مختلف از جمله شبیهسازیهای علمی، تجزیه و تحلیل دادههای بزرگ و یادگیری ماشین حل کنند.
ابرپردازش شریف، انتخابی ایدهآل برای دانشجویان و فارغالتحصیلان جویای علم و علاقهمند به حل مسائل واقعی است.