← Retour à toutes les offres

Ingénieur MLOps, systèmes LLM (serving, kernels GPU, profiling) (H/F)

Lieu: À distancePays éligibles: Canada, Royaume-Uni, États-UnisType de contrat: ContratRémunération: $90 – $120Publiée le: 8 octobre 2026

À propos du poste

L'équipe GenAI d'un laboratoire d'IA de premier plan recherche des ingénieurs MLOps expérimentés en infrastructure de grands modèles de langage dans au moins un de quatre domaines : programmation de kernels GPU, profiling de performance, débogage de charges de travail accélérées et distribuées, et serving d'inférence à haut débit. Le travail produit des données d'entraînement et d'évaluation de haute qualité pour des systèmes d'IA de pointe. Il s'agit d'un poste W-2 chez Cincinnatus LLC, placé auprès du laboratoire dans le cadre de ses effectifs étendus.

Vos missions

  • Concevoir des tâches exigeantes et rédiger des solutions précises sur les kernels GPU, le profiling, le débogage et le serving d'inférence.
  • Évaluer des tâches et des solutions de systèmes de ML et fournir des retours techniques écrits clairs.
  • Élaborer des guides, des grilles d'évaluation et des cadres d'évaluation couvrant l'optimisation de kernels, la sortie de profilers, le raisonnement distribué et les arbitrages de serving.
  • Conseiller les équipes de recherche et d'ingénierie sur les lacunes en matière de systèmes de ML et de connaissances sur l'infrastructure d'entraînement.
  • Collaborer avec d'autres experts du domaine pour garantir la cohérence des données.

Profil recherché

  • 2 ans et plus d'expérience pratique en systèmes de ML, infrastructure de ML, serving de modèles ou ingénierie de la performance GPU.
  • Expérience pratique dans au moins un domaine : kernels GPU personnalisés (CUDA, Triton, Pallas), profiling (Kineto, torch.profiler, Nsight), débogage distribué ou serving de LLM (vLLM, SGLang, TensorRT-LLM).
  • Expérience en production avec JAX et/ou PyTorch ; connaissance des accélérateurs A100, H100, B200 ou TPU.
  • Solides compétences de communication écrite et un parcours de progression de carrière.
  • Disponibilité fiable de 40 heures par semaine en semaine, sans engagements concurrents.

Rémunération et modalités

$90-$120 par heure, 40 heures par semaine à temps plein. À distance, ouvert aux candidats au Canada, au Royaume-Uni et aux États-Unis. L'emploi est en W-2 via Cincinnatus LLC, un employeur de référence (employer of record) distinct de Mercor.