← Zurück zu allen Jobs

Infrastruktur- / Site-Reliability-Engineer (SRE) (m/w/d)

Standort: RemoteZulässige Standorte: WeltweitVertragsart: TeilzeitVergütung: $200 – $200Veröffentlicht: 8. Oktober 2026

Über die Rolle

Mercor sucht Infrastruktur- und Site-Reliability-Engineers für ein Vollzeitengagement zum Aufbau und Betrieb komplexer Infrastruktur auf Unternehmensniveau für Organisationen, die an ehrgeizigen Technologie- und KI-Initiativen arbeiten. Die Kandidaten müssen sich in Vollzeit verpflichten können.

Ihre Aufgaben

  • Hochverfügbare, skalierbare Produktionsinfrastruktur aufbauen, betreiben und verbessern
  • Auf Kubernetes basierende Produktionsumgebungen und Cloud-Infrastruktur, hauptsächlich auf AWS, verwalten und optimieren
  • Observability über Infrastruktur und Anwendungen hinweg mit Datadog oder ähnlichen Tools aufbauen sowie Monitoring, Alerting, Logging und Tracing verbessern
  • Vorfälle untersuchen, Ursachenanalysen durchführen und dauerhafte Lösungen ausliefern
  • Automatisierung und interne Werkzeuge entwickeln, um manuellen Aufwand zu verringern
  • Mit Softwareentwicklern bei Deployments und Zuverlässigkeit zusammenarbeiten und zu Architekturentscheidungen beitragen

Anforderungen

  • Berufserfahrung in Infrastruktur, SRE, Plattform, DevOps oder Production Engineering
  • Fundierte Produktionserfahrung mit Kubernetes und AWS
  • Erfahrung mit Datadog, Prometheus, Grafana oder vergleichbaren Plattformen sowie mit Infrastructure as Code (Terraform, Pulumi oder Gleichwertigem)
  • Solides Verständnis von verteilten Systemen, Netzwerken, Containern und Linux; CI/CD-Erfahrung
  • Sicherer Umgang mit Python, Go, Bash oder Ähnlichem
  • Starke Signale: Betrieb in großem Maßstab, Bereitschaftsdienst und Verantwortung für Vorfälle, messbare Verbesserungen bei SLO/SLI und Zuverlässigkeit

Vergütung und Rahmenbedingungen

  • Vergütung: $200 pro Stunde
  • Vollzeit, 40 Stunden pro Woche
  • Remote, keine Standortbeschränkung angegeben