Tabbio
تسجيل الدخول إلى التطبيق
أمس

مهندس منصة أول - السحابة وKubernetes

Weekday AI · Abu Dhabi, United Arab Emirates
Workableقدّم عبر موقع الشركة
Full Time
Onsite
Senior

نبذة عن الوظيفة

𝗧𝗵𝗶𝘀 𝗿𝗼𝗹𝗲 𝗶𝘀 𝗳𝗼𝗿 𝗼𝗻𝗲 𝗼𝗳 𝘁𝗵𝗲 𝗪𝗲𝗲𝗸𝗱𝗮𝘆'𝘀 𝗰𝗹𝗶𝗲𝗻𝘁𝘀 𝗦𝗮𝗹𝗮𝗿𝘆 𝗿𝗮𝗻𝗴𝗲: 𝗥𝘀 𝟮𝟲𝟬𝟬𝟬𝟬𝟬 - 𝗥𝘀 𝟰𝟱𝟬𝟬𝟬𝟬𝟬 (𝗶𝗲 𝗜𝗡𝗥 𝟮𝟲-𝟰𝟱 𝗟𝗣𝗔)

الخبرة: 5+ سنوات الموقع: أبوظبي، الإمارات العربية المتحدة نوع الوظيفة: دوام كامل

نحن نبحث عن مهندس نظام أساسي ذو خبرة لتصميم وتنفيذ وتأمين وتشغيل الأنظمة الأساسية السحابية الأصلية القابلة للتطوير باستخدام Microsoft Azure وKubernetes. يركز الدور على بناء بيئات إنتاج عالية التوفر ومرنة وآمنة ومدارة بشكل جيد مع قيادة أفضل ممارسات الأتمتة وقابلية المراقبة والبنية التحتية كرمز وهندسة الأنظمة الأساسية. سيكون لدى المرشح المثالي خبرة عملية قوية عبر Azure وAKS وKubernetes وTerraform وCI/CD والحوكمة السحابية والأمن وقابلية المراقبة والتعافي من الكوارث، إلى جانب القدرة على توفير القيادة الفنية عبر بيئات الأنظمة الأساسية المعقدة.

المتطلبات

المسؤوليات الرئيسية

  • تصميم ونشر وإدارة البنية التحتية لـ Microsoft Azure ومنصات AKS/Kubernetes.
  • تنفيذ وصيانة حلول التعافي من الكوارث والنسخ الاحتياطي والاستعادة واستمرارية الأعمال.
  • إنشاء أتمتة البنية التحتية باستخدام مسارات Terraform وHelm وAzure DevOps وCI/CD.
  • إدارة شبكات Kubernetes، والدخول، والتخزين، ومساحات الأسماء، وحدود الموارد، والأمان، وتكوينات النظام الأساسي.
  • تنفيذ حلول المراقبة باستخدام Prometheus وGrafana وLoki وتقنيات المراقبة ذات الصلة.
  • إدارة شهادات TLS، والأسرار، وضوابط الوصول، وRBAC، وآليات أمان النظام الأساسي.
  • إنشاء حوكمة سحابية وKubernetes تغطي تنظيم الموارد والتسمية ووضع العلامات والسياسات الأمنية والمعايير التشغيلية.
  • تحديد البنية التحتية كتعليمات برمجية وإدارة CI/CD، بما في ذلك وحدات Terraform القابلة لإعادة الاستخدام، وإدارة الحالة، ومراجعات التعليمات البرمجية، وبوابات الموافقة، وتعزيز البيئة، وإدارة العناصر.
  • المشاركة في مراجعات التصميم المعماري والفني للمنصات والتطبيقات والتكاملات وتغييرات البنية التحتية.
  • تعزيز الاستعداد الأمني ​​والامتثال من خلال معالجة الثغرات الأمنية، ومراجعات الوصول، وخطوط الأساس الأمنية، وضوابط التدقيق، وإنفاذ السياسات.
  • تحديد ومراقبة توفر النظام الأساسي وSLIs وSLOs والقدرة والأداء والصحة التشغيلية.
  • إدارة الحوادث والمشكلات الرئيسية، بما في ذلك تحليل السبب الجذري، والإجراءات التصحيحية، ومنع المشكلات المتكررة.
  • تنفيذ تخطيط القدرات، وتحسين الأداء، وتحسين التكلفة السحابية / أنشطة FinOps.
  • اختبار DR الخاص، والتحقق من صحة RTO/RPO، ومعايير النسخ الاحتياطي والاسترداد، وتمارين الاسترداد الدورية.
  • تخطيط وتنفيذ عمليات ترحيل النظام الأساسي، وترقيات البنية التحتية، ومبادرات التحول السحابي.
  • تقييم تقنيات النظام الأساسي الناشئة، وإجراء POCs، وإنشاء أنماط معتمدة لاعتماد الإنتاج.
  • الحفاظ على الوثائق الفنية بما في ذلك HLDs وLLDs ومخططات الهندسة المعمارية وإجراءات التشغيل الموحدة وسجلات التشغيل وأدلة استكشاف الأخطاء وإصلاحها وإجراءات DR.
  • توفير القيادة التقنية والتوجيه وتبادل المعرفة عبر فرق هندسة النظام الأساسي.

ما الذي يجعلك مناسبًا جدًا

  • أكثر من 5 سنوات من الخبرة في هندسة الأنظمة الأساسية، أو البنية التحتية السحابية، أو DevOps، أو SRE، أو الأدوار ذات الصلة.
  • خبرة عملية قوية في Microsoft Azure وKubernetes، وخاصةً AKS.
  • خبرة قوية مع Docker وHelm وTerraform وAzure DevOps / CI/CD.
  • فهم جيد لشبكات Azure، بما في ذلك VNets وNSGs ونقاط النهاية الخاصة وجدار الحماية Azure.
  • تجربة تنفيذ إمكانية الملاحظة باستخدام Prometheus، Grafana، Loki، أو منصات مماثلة.
  • معرفة قوية بممارسات Linux وBash scripting وGit وGitOps.
  • خبرة مثبتة في التعافي من الكوارث، والنسخ الاحتياطي/الاستعادة، وتخطيط RTO/RPO، واختبار الاسترداد.
  • فهم قوي لأمان Kubernetes، والحوكمة، وRBAC، وإنفاذ السياسات، وسياسة Azure.
  • خبرة في إنشاء أنماط البنية التحتية والتعليمات البرمجية القابلة لإعادة الاستخدام ومعايير هندسة النظام الأساسي.
  • فهم قوي لإدارة CI/CD، وضوابط الإصدار، وتعزيز البيئة، ومعايير التحكم في المصدر.
  • خبرة في العمل مع قواعد البيانات مثل PostgreSQL، أو MongoDB، أو MySQL، أو Azure SQL.
  • معرفة قوية بإدارة الحوادث، وإدارة المشكلات، وRCA، وتخطيط القدرات، وتحسين الأداء، وإدارة التكاليف السحابية.
  • خبرة في العمل في البيئات التي تسيطر عليها الأمان أو الامتثال أو التدقيق أو الإدارة.
  • القدرة على إنشاء وصيانة HLDs، LLDs، المخططات المعمارية، كتيبات التشغيل التشغيلية، إجراءات التشغيل الموحدة، والوثائق الفنية.
  • خبرة قوية في المشاركة في مراجعات التصميم المعماري والفني.
  • قدرات ممتازة في استكشاف الأخطاء وإصلاحها والتحليل وحل المشكلات.
  • القيادة التقنية القوية، والتوجيه، والاتصالات، ومهارات التعاون متعدد الوظائف.
  • الخبرة في مجال الأعمال المصرفية أو غيرها من الصناعات المنظمة ستكون ميزة.
  • فهم قوي للتوافر العالي، وعمليات الإنتاج، وتحديث النظام الأساسي، ومبادرات التحول السحابي.

المسؤوليات

1𝗧𝗵𝗶𝘀 𝗿𝗼𝗹𝗲 𝗶𝘀 𝗳𝗼𝗿 𝗼𝗻𝗲 𝗼𝗳 𝘁𝗵𝗲 𝗪𝗲𝗲𝗸𝗱𝗮𝘆'𝘀 𝗰𝗹𝗶𝗲𝗻𝘁𝘀
2𝗦𝗮𝗹𝗮𝗿𝘆 𝗿𝗮𝗻𝗴𝗲: 𝗥𝘀 𝟮𝟲𝟬𝟬𝟬𝟬𝟬 - 𝗥𝘀 𝟰𝟱𝟬𝟬𝟬𝟬𝟬 (𝗶𝗲 𝗜𝗡𝗥 𝟮𝟲-𝟰𝟱 𝗟𝗣𝗔)
3Experience: 5+ yrs
4Location: Abu Dhabi, United Arab Emirates
5Job Type: Full-time
6Requirements
7Key Responsibilities
8Design, deploy, and manage Microsoft Azure infrastructure and AKS/Kubernetes platforms .

المتطلبات

1Design, deploy, and manage Microsoft Azure infrastructure and AKS/Kubernetes platforms .
2Implement and maintain Disaster Recovery, backup, restore, and business continuity solutions.
3Build infrastructure automation using Terraform, Helm, Azure DevOps, and CI/CD pipelines .
4Manage Kubernetes networking, ingress, storage, namespaces, resource limits, security, and platform configurations.
5Implement observability solutions using Prometheus, Grafana, Loki , and related monitoring technologies.
6Manage TLS certificates, secrets, access controls, RBAC, and platform security mechanisms.
7Establish cloud and Kubernetes governance covering resource organisation, naming, tagging, security policies, and operational standards.
8Define Infrastructure-as-Code and CI/CD governance , including reusable Terraform modules, state management, code reviews, approval gates, environment promotion, and artifact management.
9Participate in architecture and technical design reviews for platforms, applications, integrations, and infrastructure changes.
10Drive security and compliance readiness through vulnerability remediation, access reviews, security baselines, audit controls, and policy enforcement.
11Define and monitor platform availability, SLIs, SLOs, capacity, performance, and operational health .
12Lead incident and problem management, including root-cause analysis, corrective actions, and prevention of recurring issues.
13Perform capacity planning, performance optimisation, and cloud cost optimisation / FinOps activities.
14Own DR testing, RTO/RPO validation, backup and recovery standards, and periodic recovery exercises.

المهارات والوسوم

Weekday's Client via platformAESQLPostgreSQLMongoDBAzureDockerKubernetesDevOpsAuditBankingCompliance

احجز رابط tabbio
قبل أن يُحجز