← Zurück zu allen Jobs

MLOps-Ingenieur, LLM-Systeme (Serving, GPU-Kernel, Profiling) (m/w/d)

Standort: RemoteZulässige Standorte: Kanada, Vereinigtes Königreich, Vereinigte StaatenVertragsart: VertragVergütung: $90 – $120Veröffentlicht: 8. Oktober 2026

Über die Rolle

Das GenAI-Team eines führenden KI-Labors sucht praxiserfahrene MLOps-Ingenieure mit Erfahrung in der Infrastruktur großer Sprachmodelle in mindestens einem von vier Bereichen: GPU-Kernel-Programmierung, Performance-Profiling, Debugging beschleunigter und verteilter Workloads sowie Inferenz-Serving mit hohem Durchsatz. Die Arbeit liefert hochwertige Trainings- und Bewertungsdaten für führende KI-Systeme. Es handelt sich um eine W-2-Stelle bei Cincinnatus LLC, die als Teil der erweiterten Belegschaft des Labors dort eingesetzt wird.

Ihre Aufgaben

  • Anspruchsvolle Aufgaben entwerfen und präzise Lösungen zu GPU-Kerneln, Profiling, Debugging und Inferenz-Serving schreiben.
  • ML-Systemaufgaben und -lösungen bewerten und klares schriftliches technisches Feedback geben.
  • Richtlinien, Bewertungsraster und Bewertungsframeworks zu Kernel-Optimierung, Profiler-Ausgaben, verteiltem Schlussfolgern und Serving-Abwägungen erstellen.
  • Forschungs- und Engineering-Teams zu Wissenslücken bei ML-Systemen und Trainingsinfrastruktur beraten.
  • Mit anderen Fachexperten zusammenarbeiten, um die Daten konsistent zu halten.

Anforderungen

  • 2+ Jahre praktische Erfahrung mit ML-Systemen, ML-Infrastruktur, Modell-Serving oder GPU-Performance-Engineering.
  • Praktische Erfahrung in mindestens einem Bereich: eigene GPU-Kernel (CUDA, Triton, Pallas), Profiling (Kineto, torch.profiler, Nsight), verteiltes Debugging oder LLM-Serving (vLLM, SGLang, TensorRT-LLM).
  • Produktionserfahrung mit JAX und/oder PyTorch; Kenntnisse von A100-, H100-, B200- oder TPU-Beschleunigern.
  • Starke schriftliche Kommunikation und ein Werdegang mit erkennbarer Karriereentwicklung.
  • Verlässliche Verfügbarkeit von 40 Stunden pro Woche an Werktagen, ohne kollidierende Verpflichtungen.

Vergütung und Rahmenbedingungen

$90-$120 pro Stunde, 40 Stunden pro Woche in Vollzeit. Remote, offen für Kandidaten in Kanada, im Vereinigten Königreich und in den USA. Die Beschäftigung erfolgt als W-2 über Cincinnatus LLC, einen von Mercor getrennten Employer of Record.