Manage enterprise Kubernetes platforms using Containerization across AWS and hybrid infrastructure, enabling secure, automated, and compliant delivery of mission-critical banking applications.
Key Responsibilities
- Operate and scale Rancher-managed Kubernetes (RKE2 / EKS) clusters
- Design and implement High Availability (HA) architectures across clusters
- Establish and manage Kubernetes backup and recovery solutions (Portworx, Longhorn, Veero or Kasten)
- Own and validate Disaster Recovery (DR) strategy, failover, and testing
- Drive Infrastructure as Code (Terraform) for standardized, auditable builds
- Implement and optimize CI/CD pipelines and GitOps workflows
- Ensure platform resiliency, availability, and performance SLAs. Expert on-prem K8s such as implemented k8s distribution, managed all on-prem K8s services.
- Enforce security, compliance, and audit controls (IAM, RBAC, secrets)
- Support incident management, RCA, and regulatory readiness
- Monitoring, Troubleshooting, & Reliability (Grafana, Splunk etc.)
Core Requirements
- 7+ years of experience in Kubernetes / DevOps / platform engineering
- Bachelor’s degree in computer science, Information Technology, or related field
- Strong expertise in Kubernetes, Rancher, AWS (EKS, VPC, IAM)
- Proven experience designing HA, Backup, and DR solutions for Kubernetes
- Hands-on Terraform automation & CI/CD engineering
- Experience supporting production-critical, regulated environments
- Deep knowledge of security, networking, and observability