Ingeniero de MLOps, Sistemas de LLM (Serving, Kernels de GPU, Profiling)
Sobre el Puesto
El equipo de GenAI de un laboratorio de IA líder necesita ingenieros de MLOps con experiencia práctica en infraestructura de modelos de lenguaje de gran tamaño en al menos una de cuatro áreas: programación de kernels de GPU, profiling de rendimiento, depuración de cargas de trabajo aceleradas y distribuidas, y serving de inferencia de alto rendimiento. El trabajo produce datos de entrenamiento y evaluación de alta calidad para sistemas de IA de vanguardia. Es un puesto W-2 con Cincinnatus LLC, asignado al laboratorio como parte de su fuerza laboral ampliada.
Qué Harás
- Diseñar tareas desafiantes y escribir soluciones precisas en kernels de GPU, profiling, depuración y serving de inferencia.
- Evaluar tareas y soluciones de sistemas de ML y dar comentarios técnicos escritos claros.
- Crear guías, rúbricas y marcos de evaluación que cubran la optimización de kernels, la salida de profilers, el razonamiento distribuido y los compromisos de serving.
- Asesorar a los equipos de investigación e ingeniería sobre carencias en el conocimiento de sistemas de ML y de infraestructura de entrenamiento.
- Trabajar con otros expertos en la materia para mantener la coherencia de los datos.
Requisitos
- 2+ años de experiencia práctica en sistemas de ML, infraestructura de ML, serving de modelos o ingeniería de rendimiento en GPU.
- Experiencia práctica en al menos un área: kernels de GPU personalizados (CUDA, Triton, Pallas), profiling (Kineto, torch.profiler, Nsight), depuración distribuida o serving de LLM (vLLM, SGLang, TensorRT-LLM).
- Experiencia en producción con JAX y/o PyTorch; conocimiento de aceleradores A100, H100, B200 o TPU.
- Buena comunicación escrita y una trayectoria de progresión profesional.
- Disponibilidad fiable de 40 horas por semana en días laborables, sin compromisos que lo impidan.
Compensación y Logística
$90-$120 por hora, 40 horas semanales a tiempo completo. Remoto, abierto a candidatos en Canadá, el Reino Unido y EE. UU. La contratación es W-2 a través de Cincinnatus LLC, un empleador de registro (employer of record) independiente de Mercor.
Empleos relacionados
Expertos en Biología Molecular - EE. UU.
Expertos en biología molecular en EE. UU. diseñan y revisan tareas de secuencias de ADN/ARN para entrenar los modelos de un laboratorio de IA líder mediante una asignación W-2. Remoto (EE. UU.), $70-$105/h.
Expertos en Biología Molecular - Reino Unido
Expertos en biología molecular en el Reino Unido diseñan y revisan tareas de secuencias de ADN/ARN para entrenar los modelos de un laboratorio de IA líder mediante una asignación W-2. Remoto (Reino Unido), $70-$105/h.
Experto en Excel — Finanzas
Profesionales de finanzas con habilidades avanzadas de Excel diseñan y evalúan tareas de modelado en Excel para entrenar modelos de IA de una empresa tecnológica líder. Remoto EE. UU., $70-$100/h.
