**Please strictly adhere to the following resume naming convention:
ALL CAPS, NO SPACES BETWEEN UNDERSCORES
PTN_US_GBAMSREQID_CandidateBeelineID
Example: PTN_US_9999999_SKIPJOHNSON0413
: -
MSP Owner: Michelle Lee
Location: Long Lake, WA
Duration: 6 months
skill id: 10878828
Role Description
• Experience supporting large-scale distributed systems (200+ microservices).
• Strong hands-on experience with FluxCD for GitOps-based continuous delivery.
• Experience implementing and managing:
o GitOps deployment patterns
o Automated Kubernetes application reconciliation
o Multi-environment deployment strategies
o Progressive delivery and automated rollbacks
o Configuration and secret management
o Helm-based application deployments through FluxCD
• Expertise integrating FluxCD with Enterprise GitHub, Jenkins, Azure Container Registry (ACR), and Kubernetes clusters.
• Experience managing platform releases for 200+ microservices using GitOps principles.
• Ability to troubleshoot deployment drift, reconciliation failures, and cluster synchronization issues.
• Strong understanding of:
o SLI/SLO/SLA management
o Incident Management
o Problem Management
o Capacity Planning
o Reliability Engineering
o Root Cause Analysis (RCA)
o Chaos Engineering principles
Required Skills
Site Reliability Engineering
• Reliability Engineering
• SLI/SLO/SLA management
• Incident Management
• Problem Management
• Capacity Planning
• Root Cause Analysis (RCA)
• Chaos Engineering principles
Kubernetes & GitOps
• Kubernetes
• FluxCD
• GitOps deployment patterns
• Automated Kubernetes application reconciliation
• Multi-environment deployment strategies
• Progressive delivery
• Automated rollbacks
• Helm-based application deployments through FluxCD
• Configuration and secret management
Platform Operations
• Experience supporting large-scale distributed systems (200+ microservices)
• Experience managing platform releases for 200+ microservices using GitOps principles
• Troubleshooting deployment drift
• Reconciliation failures
• Cluster synchronization issues
DevOps & Automation
• CI/CD automation
• Terraform
• GitHub
• Jenkins
• Azure Container Registry (ACR)
Application & Messaging Technologies
• Java ecosystem
• Kafka
• ActiveMQ
• Event-driven architectures
• Modern UI applications
Observability & Database Operations
• Observability
• Database operations
Cloud-Native Platforms
• Cloud-native environments
Candidate Profile
• We are seeking a highly skilled Senior Platform Site Reliability Engineer (SRE) to support and operate a large-scale distributed platform consisting of 200+ Java-based microservices, event-driven architectures, modern UI applications, and enterprise-grade databases.
• The candidate will drive platform reliability, scalability, observability, automation, and operational excellence across cloud-native environments.
• The ideal engineer will have strong expertise in Kubernetes, FluxCD, Terraform, Java ecosystem, Kafka/ActiveMQ messaging, CI/CD automation, observability, and database operations, with a mindset focused on reliability engineering, automation, and production support.
Skills: Digital : Kafka ~ Digital : Kubernetes ~ Digital: Terraform ~ Java Scheduler Tools - Quartz| Flux ~ ActiveMQ
Experience Required: 10 & Above
ALL CAPS, NO SPACES BETWEEN UNDERSCORES
PTN_US_GBAMSREQID_CandidateBeelineID
Example: PTN_US_9999999_SKIPJOHNSON0413
: -
MSP Owner: Michelle Lee
Location: Long Lake, WA
Duration: 6 months
skill id: 10878828
Role Description
• Experience supporting large-scale distributed systems (200+ microservices).
• Strong hands-on experience with FluxCD for GitOps-based continuous delivery.
• Experience implementing and managing:
o GitOps deployment patterns
o Automated Kubernetes application reconciliation
o Multi-environment deployment strategies
o Progressive delivery and automated rollbacks
o Configuration and secret management
o Helm-based application deployments through FluxCD
• Expertise integrating FluxCD with Enterprise GitHub, Jenkins, Azure Container Registry (ACR), and Kubernetes clusters.
• Experience managing platform releases for 200+ microservices using GitOps principles.
• Ability to troubleshoot deployment drift, reconciliation failures, and cluster synchronization issues.
• Strong understanding of:
o SLI/SLO/SLA management
o Incident Management
o Problem Management
o Capacity Planning
o Reliability Engineering
o Root Cause Analysis (RCA)
o Chaos Engineering principles
Required Skills
Site Reliability Engineering
• Reliability Engineering
• SLI/SLO/SLA management
• Incident Management
• Problem Management
• Capacity Planning
• Root Cause Analysis (RCA)
• Chaos Engineering principles
Kubernetes & GitOps
• Kubernetes
• FluxCD
• GitOps deployment patterns
• Automated Kubernetes application reconciliation
• Multi-environment deployment strategies
• Progressive delivery
• Automated rollbacks
• Helm-based application deployments through FluxCD
• Configuration and secret management
Platform Operations
• Experience supporting large-scale distributed systems (200+ microservices)
• Experience managing platform releases for 200+ microservices using GitOps principles
• Troubleshooting deployment drift
• Reconciliation failures
• Cluster synchronization issues
DevOps & Automation
• CI/CD automation
• Terraform
• GitHub
• Jenkins
• Azure Container Registry (ACR)
Application & Messaging Technologies
• Java ecosystem
• Kafka
• ActiveMQ
• Event-driven architectures
• Modern UI applications
Observability & Database Operations
• Observability
• Database operations
Cloud-Native Platforms
• Cloud-native environments
Candidate Profile
• We are seeking a highly skilled Senior Platform Site Reliability Engineer (SRE) to support and operate a large-scale distributed platform consisting of 200+ Java-based microservices, event-driven architectures, modern UI applications, and enterprise-grade databases.
• The candidate will drive platform reliability, scalability, observability, automation, and operational excellence across cloud-native environments.
• The ideal engineer will have strong expertise in Kubernetes, FluxCD, Terraform, Java ecosystem, Kafka/ActiveMQ messaging, CI/CD automation, observability, and database operations, with a mindset focused on reliability engineering, automation, and production support.
Skills: Digital : Kafka ~ Digital : Kubernetes ~ Digital: Terraform ~ Java Scheduler Tools - Quartz| Flux ~ ActiveMQ
Experience Required: 10 & Above