MLOps-Ingenieur, LLM-Systeme (Serving, GPU-Kernel, Profiling) (m/w/d)
Über die Rolle
Das GenAI-Team eines führenden KI-Labors sucht praxiserfahrene MLOps-Ingenieure mit Erfahrung in der Infrastruktur großer Sprachmodelle in mindestens einem von vier Bereichen: GPU-Kernel-Programmierung, Performance-Profiling, Debugging beschleunigter und verteilter Workloads sowie Inferenz-Serving mit hohem Durchsatz. Die Arbeit liefert hochwertige Trainings- und Bewertungsdaten für führende KI-Systeme. Es handelt sich um eine W-2-Stelle bei Cincinnatus LLC, die als Teil der erweiterten Belegschaft des Labors dort eingesetzt wird.
Ihre Aufgaben
- Anspruchsvolle Aufgaben entwerfen und präzise Lösungen zu GPU-Kerneln, Profiling, Debugging und Inferenz-Serving schreiben.
- ML-Systemaufgaben und -lösungen bewerten und klares schriftliches technisches Feedback geben.
- Richtlinien, Bewertungsraster und Bewertungsframeworks zu Kernel-Optimierung, Profiler-Ausgaben, verteiltem Schlussfolgern und Serving-Abwägungen erstellen.
- Forschungs- und Engineering-Teams zu Wissenslücken bei ML-Systemen und Trainingsinfrastruktur beraten.
- Mit anderen Fachexperten zusammenarbeiten, um die Daten konsistent zu halten.
Anforderungen
- 2+ Jahre praktische Erfahrung mit ML-Systemen, ML-Infrastruktur, Modell-Serving oder GPU-Performance-Engineering.
- Praktische Erfahrung in mindestens einem Bereich: eigene GPU-Kernel (CUDA, Triton, Pallas), Profiling (Kineto, torch.profiler, Nsight), verteiltes Debugging oder LLM-Serving (vLLM, SGLang, TensorRT-LLM).
- Produktionserfahrung mit JAX und/oder PyTorch; Kenntnisse von A100-, H100-, B200- oder TPU-Beschleunigern.
- Starke schriftliche Kommunikation und ein Werdegang mit erkennbarer Karriereentwicklung.
- Verlässliche Verfügbarkeit von 40 Stunden pro Woche an Werktagen, ohne kollidierende Verpflichtungen.
Vergütung und Rahmenbedingungen
$90-$120 pro Stunde, 40 Stunden pro Woche in Vollzeit. Remote, offen für Kandidaten in Kanada, im Vereinigten Königreich und in den USA. Die Beschäftigung erfolgt als W-2 über Cincinnatus LLC, einen von Mercor getrennten Employer of Record.
Ähnliche Rollen
Experten für Molekularbiologie - USA (m/w/d)
Molekularbiologie-Experten in den USA entwerfen und prüfen DNA-/RNA-Sequenzaufgaben, um die Modelle eines führenden KI-Labors zu trainieren, über eine W-2-Anstellung. Remote (USA), $70-$105/Std.
Experten für Molekularbiologie - Vereinigtes Königreich (m/w/d)
Molekularbiologie-Experten im Vereinigten Königreich entwerfen und prüfen DNA-/RNA-Sequenzaufgaben, um die Modelle eines führenden KI-Labors zu trainieren, über eine W-2-Anstellung. Remote (UK), $70-$105/Std.
Excel-Experte – Finanzen (m/w/d)
Finanzfachleute mit fortgeschrittenen Excel-Kenntnissen entwerfen und bewerten Excel-Modellierungsaufgaben, um KI-Modelle eines führenden Technologieunternehmens zu trainieren. Remote (USA), $70-$100/Std.
