Remote Site Reliability Engineer jobs open to United States.
United States? Yes. $$$? When they say. Stack? Before the essay.
52 openings. None older than 30 days.
Newest first
Senior Site Reliability Engineer - FedRAMP
about 13 hours agoPython · Azure · Kubernetes
8 years of experience, Azure, Datadog, SLIs, SLOs, Incident response, Kubernetes, Terraform, PowerShell, Python, Networking fundamentals, Observability platform management, FedRAMP compliance, Infrastructure as code, CI/CD pipelines, Web application firewall administration, Disaster recovery strategies, Clear written communication
Incident Operations Commander
about 13 hours ago4 years of experience, Incident command, High-severity incident management, Technical operations, FinTech understanding, AI tools usage, Cross-region handoffs, Clear communication, Accountability under pressure
Senior Software Engineer - SRE
3 days agoSite Reliability Engineering experience, PostgreSQL, Temporal workflows, Grafana or Honeycomb, OpenTelemetry
Staff Security Engineer - PAM and Agentic Identity
3 days agoKubernetes
8 years of experience, PAM expertise, NHI solutions, Linux/Windows environments, Kubernetes, CI/CD systems, Idira/CyberArk, HashiCorp Vault, Operational tooling, Short-lived credentials, Identity-aware proxies, Session recording
Senior Infrastructure Engineer - Infrastructure Security and Core Services
4 days ago12 years of experience, Infrastructure security, Large scale hybrid networks, Automation pipelines, Mellanox networking, Compute technologies, Storage architectures, Data lakes, Test Automation infrastructures, CPU and GPU workloads
Senior GCP Cloud Infrastructure Engineer
4 days agoGCP
8 years of experience, GCP landing zones, FedRAMP compliance, IAM models with external IdP, Assured Workloads provisioning, Infrastructure-as-Code, VPC/VPN configuration, Cloud Operations Suite, API Gateway implementation
Azure Infrastructure Engineer
4 days agoPython · Azure · Kubernetes
6 years of experience, Azure core services, Infrastructure-as-code (Terraform, Bicep, ARM), Azure Kubernetes Service (AKS), Azure DevOps or GitHub Actions, PowerShell, Bash, Python, Cloud security principles, Monitoring and observability strategies, Hybrid cloud or multi-cloud experience
Kubernetes & OpenShift Engineer
4 days agoPython · Kubernetes
6 years of experience, Kubernetes internals, OpenShift internals, Linux administration, Infrastructure-as-code (Ansible, Terraform, Helm), CI/CD pipelines (Tekton, Jenkins, Argo CD), Scripting (Bash, Python, Go), Cluster monitoring and logging, Container image security
Observability Engineer
4 days ago12 years of experience, Prometheus, Grafana, Datadog, OpenTelemetry, Distributed tracing, High-cardinality metrics, SLOs, CI/CD integration, Linux internals, Container platforms
Platform Networking Engineer
4 days agoPython · Kubernetes
6 years of experience, Istio, Linkerd, Envoy, Kubernetes, mTLS, PKI, Go, Python, Distributed tracing, Service mesh production experience
Site Reliability Engineer (SRE)
4 days agoPython · Kubernetes
10 years of experience, Kubernetes, Python, Go, Chaos engineering, SLOs and error budgets, Prometheus, Grafana, CI/CD pipelines, Distributed systems design, Incident response leadership
Platform Engineer (remote work)
4 days agoKubernetes
Linux systems administration, Kubernetes in production, Infrastructure as code (Ansible, Terraform), GitLab administration, Prometheus and Grafana, Technical writing for engineers, Strong communication skills, Advanced use of AI engineering assistants
Senior Site Reliability Engineer
5 days agoPython · AWS · Kubernetes
4 years of experience, Kubernetes, Terraform, AWS, Production observability, Python, Go, AI tools, HIPAA compliance, Cloud cost-efficiency
Cloud Infrastructure Engineer – AWS
5 days agoPython · AWS · Kubernetes
10 years of experience, AWS, Terraform, AWS CloudFormation, Kubernetes, DevOps, Cloud Security, Site Reliability Engineering, CI/CD, Python, Bash, AWS Organizations, FinOps, Disaster Recovery, Cloud Governance
Cloud Infrastructure Network Engineer
5 days agoKubernetes
6 years of experience, Cloud networking, VPC/VNet design, Hybrid connectivity, Infrastructure-as-code (Terraform), Cloud security and network controls, Kubernetes networking, Multi-cloud networking, SD-WAN familiarity, eBPF-based networking tools, Regulated industries exposure
Kafka Engineer
5 days agoKubernetes
7 years of experience, Kafka internals, Kafka security, Kafka Connect, Infrastructure-as-code, Observability tooling, DevOps practices, Kubernetes (Strimzi, Confluent Operator)
Observability Engineer
5 days agoPython · Java
6 years of experience, Prometheus, Grafana, Datadog, New Relic, Splunk, OpenTelemetry, distributed tracing, structured logging, Go, Python, Java, high-cardinality metrics, SLOs, error budgets, SRE principles, CI/CD integration, Linux internals, networking, container platforms, Thanos, Mimir, Cortex, Loki, Tempo, eBPF, cost optimization, regulated environments
OpenShift Platform Engineer
5 days agoPython · Kubernetes
8 years of experience, OpenShift, Kubernetes internals, Linux administration, Infrastructure-as-code (Ansible, Terraform, Helm), CI/CD pipelines (Tekton, Jenkins, Argo CD), Scripting (Bash, Python, Go), Container image security, Cluster monitoring and logging, Service mesh (OpenShift Service Mesh, Istio, Linkerd), GitOps workflows (Argo CD, Flux)
SAP Basis Administrator
5 days agoPython · AWS · Azure
10 years of experience, SAP HANA, S/4HANA, ECC, BW/4HANA, Cloud migrations (AWS, Azure, GCP), SAP upgrades, HANA System Replication, SAP transport management, Ansible, PowerShell, Python, Strong troubleshooting skills
Service Mesh Architect
5 days agoPython · Kubernetes
6 years of experience, Istio, Linkerd, Envoy, Kubernetes, mTLS, PKI, Go, Python, Distributed tracing, Cilium, SPIFFE/SPIRE, Zero-trust networking
Senior Site Reliability Engineer - HPC
9 days agoPython · Ruby · Kubernetes
5 years of experience, HPC cluster support, Slurm or LSF or Kubernetes, Infrastructure as Code (IaC), CI/CD techniques, Automated host lifecycle management, E2E observability, Python or Go or Perl or Ruby, Technical mentoring, Published technical write-ups, Open source component maintenance
DevOps & SRE Engineer
9 days agoPython · Java · AWS
6 years of experience, Python, Go, Java, Kubernetes, Linux at scale, Prometheus, Grafana, CI/CD pipelines, SLOs, Chaos engineering, AWS, Azure, GCP
Telemetry Engineer
9 days agoPython · Java
6 years of experience, Prometheus, Grafana, OpenTelemetry, Datadog, New Relic, Splunk, Go, Python, Java, SRE principles, distributed tracing, structured logging, Linux, containers, CI/CD
Platform Engineer
10 days agoAWS · Kubernetes
Kubernetes, Bare-metal infrastructure, Infrastructure as code (Terraform), CI/CD (GitLab CI), Linux/Unix administration, AWS (EC2, EKS, IAM), GPU-enabled infrastructure, YAML for Kubernetes manifests, Security clearance eligibility
Kubernetes Service Engineer
10 days agoPython · Kubernetes
6 years of experience, Istio, Linkerd, Envoy, mTLS, Kubernetes, Go, Python, Distributed tracing, Traffic management policies, Service mesh architecture
Platform Reliability Engineer
10 days agoPython · Java · AWS
6 years of experience, Python, Go, Java, Kubernetes, Linux at scale, Prometheus, Grafana, CI/CD pipelines, Distributed system design, SLOs and error budgets, Chaos engineering, AWS, Azure, GCP
Systems Observability Specialist
10 days agoPython · Java
6 years of experience, Prometheus, Grafana, Datadog, New Relic, Splunk, OpenTelemetry, distributed tracing, structured logging, Go, Python, Java, high-cardinality metrics, high-throughput log pipelines, SLOs, error budgets, SRE principles, CI/CD integration, Linux internals, networking, container platforms
AWS Senior SRE Consultant
10 days agoPython · AWS · Kubernetes
AWS observability solutions, Automated disaster recovery, Infrastructure-as-Code, Python, Terraform, Docker, Kubernetes, DataDog, Splunk, Grafana, AWS CloudFormation, AWS CLI, AWS CDK, Customer-facing experience
Senior IT Infrastructure Engineer
11 days agoAWS
5 years of experience, AWS administration, Linux server administration, Infrastructure as code, macOS fleet management, Identity provider administration, Terraform, Incident response, Data platform infrastructure
Reliability Engineer
12 days agoPython · Java · AWS
6 years of experience, Python, Go, Java, Kubernetes, Linux, Prometheus, Grafana, CI/CD pipelines, SLOs, Chaos engineering, AWS, Azure, GCP