Staff Site Reliability Engineer

Added
3 minutes ago
Type
Full time
Salary
Upgrade to Premium to se...

Related skills

aws lambda s3 kubernetes eks

πŸ“‹ Description

  • Drive reliability engineering initiatives for AWS and Kubernetes services.
  • Design deployment, release, and rollback strategies for distributed systems.
  • Establish secure-by-default CI/CD pipelines with governance.
  • Enhance observability with metrics, logs, tracing, and alerting.
  • Define SLIs/SLOs and reliability standards.
  • Lead high-severity incident responses and post-incident reviews.

🎯 Requirements

  • 8+ years in SRE/Platform Eng/DevOps or related cloud-native roles.
  • Deep AWS experience (EKS, IAM, VPC, Lambda, CloudFront, S3).
  • Advanced experience with production Kubernetes operations.
  • Strong Istio experience (traffic, security, observability).
  • IaC expertise, preferably AWS CDK.
  • CI/CD with GitHub Actions or similar.

🎁 Benefits

  • Observability tooling experience (CloudWatch, OpenTelemetry, X-Ray).
  • Experience with SLI/SLOs, alerting, runbooks, reliability metrics.
  • TypeScript/Node.js for platform tooling and automation.
  • Kubernetes architecture, Gateway API, ingress, networking.
  • Zero-trust, mTLS, service-to-service security controls.
  • Automated testing, code reviews, observability-driven development.
Share job

Meet JobCopilot: Your Personal AI Job Hunter

Automatically Apply to Engineering Jobs. Just set your preferences and Job Copilot will do the rest β€” finding, filtering, and applying while you focus on what matters.

Related Engineering Jobs

See more Engineering jobs β†’