Ingénieur MLOps, systèmes LLM (serving, kernels GPU, profiling) (H/F)
À propos du poste
L'équipe GenAI d'un laboratoire d'IA de premier plan recherche des ingénieurs MLOps expérimentés en infrastructure de grands modèles de langage dans au moins un de quatre domaines : programmation de kernels GPU, profiling de performance, débogage de charges de travail accélérées et distribuées, et serving d'inférence à haut débit. Le travail produit des données d'entraînement et d'évaluation de haute qualité pour des systèmes d'IA de pointe. Il s'agit d'un poste W-2 chez Cincinnatus LLC, placé auprès du laboratoire dans le cadre de ses effectifs étendus.
Vos missions
- Concevoir des tâches exigeantes et rédiger des solutions précises sur les kernels GPU, le profiling, le débogage et le serving d'inférence.
- Évaluer des tâches et des solutions de systèmes de ML et fournir des retours techniques écrits clairs.
- Élaborer des guides, des grilles d'évaluation et des cadres d'évaluation couvrant l'optimisation de kernels, la sortie de profilers, le raisonnement distribué et les arbitrages de serving.
- Conseiller les équipes de recherche et d'ingénierie sur les lacunes en matière de systèmes de ML et de connaissances sur l'infrastructure d'entraînement.
- Collaborer avec d'autres experts du domaine pour garantir la cohérence des données.
Profil recherché
- 2 ans et plus d'expérience pratique en systèmes de ML, infrastructure de ML, serving de modèles ou ingénierie de la performance GPU.
- Expérience pratique dans au moins un domaine : kernels GPU personnalisés (CUDA, Triton, Pallas), profiling (Kineto, torch.profiler, Nsight), débogage distribué ou serving de LLM (vLLM, SGLang, TensorRT-LLM).
- Expérience en production avec JAX et/ou PyTorch ; connaissance des accélérateurs A100, H100, B200 ou TPU.
- Solides compétences de communication écrite et un parcours de progression de carrière.
- Disponibilité fiable de 40 heures par semaine en semaine, sans engagements concurrents.
Rémunération et modalités
$90-$120 par heure, 40 heures par semaine à temps plein. À distance, ouvert aux candidats au Canada, au Royaume-Uni et aux États-Unis. L'emploi est en W-2 via Cincinnatus LLC, un employeur de référence (employer of record) distinct de Mercor.
Postes similaires
Product designer senior, UI/UX (H/F)
Mercor propose un poste à temps plein en W-2 pour des product designers seniors qui prototypent des interfaces et relisent des interfaces générées par IA pour un laboratoire d'IA de premier plan. À distance (États-Unis), $80-$110/h.
Ingénieur en mécanique (H/F)
Mercor propose un poste à temps plein en W-2 pour des ingénieurs en mécanique expérimentés qui relisent des productions d'IA et rédigent des solutions de référence pour un laboratoire d'IA. À distance (États-Unis), $60-$90/h.
Ingénieur Lean, mathématiques formelles (Lean 4, Mathlib, démonstration de théorèmes) (H/F)
Mercor recrute des ingénieurs Lean 4 pour écrire et relire des preuves vérifiées par machine et des énoncés formels pour un laboratoire d'IA de premier plan. À distance, $90-$110/h, 20 h+/semaine.
