شرح موقعیت
شرح شغل طراحی، پیادهسازی و نگهداری پایپلاینهای CI/CD بهمنظور تحویل سریع و پایدار نرمافزار مدیریت و بهینهسازی پلتفرمهای ارکستریشن کانتینر (Kubernetes) و زیرساختهای Cloud-Native پایش سلامت و عملکرد سیستمها با استفاده از ابزارهای Observability (Prometheus، Grafana، ELK Stack) و رسیدگی به رخدادها خودکارسازی فرآیندهای تامین زیرساخت، مدیریت پیکربندی و فعالیتهای عملیاتی همکاری نزدیک با تیمهای Backend و Frontend برای بهبود فرآیندهای استقرار و افزایش پایداری سرویسها مشارکت در برنامهریزی ظرفیت، بهینهسازی عملکرد و مدیریت هزینهها همراهی در پروژههای نوسازی زیرساخت شامل ارتقا سیستمها، مهاجرتها و بهبود معماری تعریف و پایش SLI، SLO و Error Budget بهمنظور تحقق اهداف پایداری سرویس نگارش و نگهداری Runbookها، مستندات فنی و گزارشهای پس از رخداد مشارکت در شیفتهای On-call و فرآیندهای پاسخگویی به Incident آشنایی با پایگاههای داده رابطهای مانند MSSQL، PostgreSQL و MySQL امتیاز محسوب میشود
نیازمندیها
- حداقل 3 سال تجربه کاری در نقشهای DevOps، SRE یا مهندسی زیرساخت
- تسلط بالا بر مدیریت سیستمعامل Linux (ترجیحاً خانواده RHEL / CentOS / AlmaLinux)
- تجربه عملی کار با Kubernetes
- تجربه استفاده از ابزارهای CI/CD (مانند GitLab CI یا مشابه)
- مهارت در اسکریپتنویسی و اتوماسیون با Bash و Python
- تجربه پیکربندی و مدیریت NGINX و HAProxy
- آشنایی با ابزارهای Infrastructure as Code
- درک قوی از مفاهیم شبکه شامل TCP/IP، DNS، Load Balancing، Firewall و iptables
- تجربه کار با ابزارهای Monitoring و Observability مانند Prometheus، Grafana، Elasticsearch و Kibana
- آشنایی با مفاهیم و رویکردهای SRE شامل SLI، SLO، SLA و Error Budget
- آشنایی با راهکارهای مدیریت هویت و دسترسی (Keycloak، OAuth / OIDC)
- تجربه کار با Pipelineهای لاگ مبتنی بر ELK (Filebeat، Logstash، Elasticsearch)
- آشنایی با Message Brokerها و سیستمهای Cache مانند RabbitMQ، Redis و Kafka
- آشنایی با سیستمهای ذخیرهسازی توزیعشده مانند Ceph، SeaweedFS یا مشابه
مزایا
- فرصت کار روی زیرساختهای چالشبرانگیز در مقیاس بزرگ
- محیط کاری حرفهای، مشارکتی و حمایتی
- فرصت رشد حرفهای و یادگیری مستمر
- حقوق و مزایای رقابتی