شرح موقعیت
ما در نئور روی پروژههایی کار میکنیم که با استفاده از هوش مصنوعی، یادگیری ماشین و تحلیل دادههای کلان به بهبود تصمیمگیریها و بهینهسازی فرآیندها کمک میکنن. تیم ما ترکیبیه از آدمهایی با تجربه و با انگیزه که دنبال توسعهی راهکارهای نوآورانه در دنیای دیتا هستن. چرا این موقعیت جذابه؟ چون اینجا فقط قرار نیست کد بزنی؛ فرصت داری با چالشهای واقعی داده و سرویسهای مقیاسپذیر روبهرو بشی و در کنار تیمی یادگیرنده و تخصصی رشد کنی. مسئولیت ها و وظایف اصلی: طراحی، پیادهسازی و نگهداری زیرساختهای Kubernetes و سرویسهای وابسته در محیطهای Production. ایجاد و مدیریت فرآیندهای CI/CD برای خودکارسازی Build، Test و Deploy مدیریت و پیکربندی سرورها و زیرساختهای ابری یا داخلی با استفاده از Ansible استقرار، پیکربندی و نگهداری سرویسها و اپلیکیشنها در محیطهای مختلف (Development، Test، Production) پیادهسازی و مدیریت فرآیندهای GitOps با استفاده از ArgoCD و الگوی معماری App-of-Apps. پایش (Monitoring) و تحلیل عملکرد سیستمها و سرویسها مدیریت لاگها و ابزارهای مانیتورینگ برای شناسایی سریع خطاها استقرار، پیکربندی و نگهداری راهکارهای Kubernetes Storage، از جمله TopoLVM و OpenEBS. تحلیل و عیبیابی مشکلات سیستمعامل، شبکه، کرنل، Storage و سرویسهای توزیعشده. پیادهسازی و نظارت بر استانداردهای امنیت، مدیریت دسترسی و احراز هویت با استفاده از Keycloak و فناوریهای SSO و OIDC. انجام Capacity Planning و بهینهسازی مصرف منابع زیرساختی. پیادهسازی راهکارهای مقیاسپذیری، دسترسپذیری بالا (High Availability) و پشتیبانگیری (Backup) همکاری با تیمهای توسعه برای بهینهسازی فرآیند Build و Deploy پیادهسازی و نظارت بر استانداردهای امنیت در زیرساخت و استقرار مستندسازی زیرساختها، فرآیندها و تنظیمات سیستم شایستگی های تخصصی: تجربه عملی در استقرار، مدیریت و عیبیابی کلاسترهای Kubernetes در محیط Production. شناخت معماری Kubernetes، Control Plane، Worker Nodes، Networking، Scheduling و Storage. تجربه کار با Cilium بهعنوان CNI و راهکارهای مبتنی بر eBPF. توانایی تحلیل مشکلات ارتباطی، Performance و Reliability در کلاسترها. مهارت عملی در Ansible و توسعه Playbookهای قابل نگهداری و قابل استفاده مجدد. تجربه اتوماسیون پیکربندی سرورها، Bare-metalها و زیرساختهای Production. تجربه عملی در طراحی و نگهداری Pipelineهای GitLab CI/CD. تجربه پیادهسازی و مدیریت GitOps با ArgoCD و آشنایی با معماری App-of-Apps. تجربه استقرار و نگهداری VictoriaMetrics و اجزای مرتبط و طراحی Dashboardهای مانیتورینگ با Grafana. تجربه مدیریت Logging، جمعآوری، پردازش، جستوجو و بهینهسازی لاگها با Elasticsearch و Kibana. تجربه کار با راهکارهای Kubernetes Storage، از جمله TopoLVM و OpenEBS. آشنایی با مفاهیم Local Storage، CSI، ظرفیتسنجی و مدیریت منابع ذخیرهسازی. تجربه راهاندازی و نگهداری Keycloak و آشنایی با SSO، OIDC، Authentication و Authorization. توانایی عیبیابی مشکلات سیستمعامل، شبکه، کرنل، Storage و سرویسهای توزیعشده. آشنایی با معماریهای High Availability، Fault Tolerance و Disaster Recovery. تجربه کار با Ceph، Object Storage / S3 و Block Storage بهعنوان مزیت. آشنایی با MLOps، زیرساخت GPU و Model Serving بهعنوان مزیت. آشنایی با DataOps و زیرساختهای Big Data مانند Hadoop، HDFS، ClickHouse و Kafka بهعنوان مزیت. توانایی اسکریپتنویسی و توسعه ابزارهای اتوماسیون با Python یا Golang بهعنوان مزیت. شایستگیهای عمومی و رفتاری: توانایی تحلیل و حل مسئله در شرایط بحرانی دقت بالا در پیکربندی سیستمها و زیرساختها توانایی مستندسازی دقیق فرآیندها مدیریت زمان و اولویتبندی وظایف تمایل به یادگیری مستمر فناوریهای جدید توانایی کار تیمی و تعامل مؤثر با تیمهای توسعه و عملیات مسئولیتپذیری بالا در حفظ پایداری سیستمها توانایی مدیریت فشار کاری در زمان رخدادهای عملیاتی رویکرد پیشگیرانه در شناسایی و رفع مشکلات احتمالی
نیازمندیها
- Docker
- DevOps
- Linux
- CI/CD