Skip to content
AI Engineer Jobs
NVIDIA

Staff Site Reliability Engineer - AI Platform Runtime

NVIDIA

Location
Hybrid (Santa Clara, California)
Compensation
$168k - $333k/yr
Employment
Full-time
Level
Senior Level
Posted 2 days ago

About the Role

NVIDIA is seeking a Staff Site Reliability Engineer to lead technical strategy for large-scale SRE initiatives across its AI Platform Runtime. The role involves designing resilient distributed systems, driving automation, and enhancing observability to support next-generation AI-driven enterprise products.

Skills

Site Reliability Engineering Kubernetes Python Typescript JavaScript Go AWS Azure GCP Infrastructure-as-code Terraform OpenTelemetry System Architecture Automation Observability Cloud Computing

Benefits

  • Health Insurance
  • Equity

Perks

  • Hybrid Work
  • Equity

Full job details