Engenheiro de MLOps, Sistemas de LLM (Serving, Kernels de GPU, Profiling)
Sobre a Função
A equipa de GenAI de um laboratório de IA de topo precisa de engenheiros de MLOps com experiência prática em infraestrutura de modelos de linguagem de grande dimensão em pelo menos uma de quatro áreas: programação de kernels de GPU, profiling de desempenho, depuração de cargas de trabalho aceleradas e distribuídas, e serving de inferência de alto débito. O trabalho produz dados de treino e avaliação de alta qualidade para sistemas de IA de ponta. É uma posição W-2 com a Cincinnatus LLC, colocada no laboratório como parte da sua força de trabalho alargada.
O Que Vais Fazer
- Conceber tarefas desafiantes e escrever soluções rigorosas em kernels de GPU, profiling, depuração e serving de inferência.
- Avaliar tarefas e soluções de sistemas de ML e dar feedback técnico escrito claro.
- Criar diretrizes, grelhas de avaliação e frameworks de avaliação que cubram otimização de kernels, resultados de profilers, raciocínio distribuído e compromissos de serving.
- Aconselhar as equipas de investigação e engenharia sobre lacunas no conhecimento de sistemas de ML e de infraestrutura de treino.
- Trabalhar com outros especialistas na matéria para manter os dados consistentes.
Requisitos
- 2+ anos de experiência prática em sistemas de ML, infraestrutura de ML, serving de modelos ou engenharia de desempenho em GPU.
- Experiência prática em pelo menos uma área: kernels de GPU personalizados (CUDA, Triton, Pallas), profiling (Kineto, torch.profiler, Nsight), depuração distribuída ou serving de LLM (vLLM, SGLang, TensorRT-LLM).
- Experiência em produção com JAX e/ou PyTorch; conhecimento de aceleradores A100, H100, B200 ou TPU.
- Boa comunicação escrita e um percurso de progressão na carreira.
- Disponibilidade fiável para 40 horas por semana em dias úteis, sem compromissos conflituantes.
Compensação e Logística
$90-$120 por hora, 40 horas por semana a tempo inteiro. Remoto, aberto a candidatos no Canadá, no Reino Unido e nos EUA. O vínculo é W-2 através da Cincinnatus LLC, uma entidade empregadora de registo (employer of record) separada da Mercor.
Vagas relacionadas
Especialistas em Biologia Molecular - EUA
Especialistas em biologia molecular nos EUA desenham e revêm tarefas de sequências de ADN/ARN para treinar os modelos de um laboratório de IA líder, através de uma colocação W-2. Remoto (EUA), $70-$105/h.
Especialistas em Biologia Molecular - Reino Unido
Especialistas em biologia molecular no Reino Unido desenham e revêm tarefas de sequências de ADN/ARN para treinar os modelos de um laboratório de IA líder, através de uma colocação W-2. Remoto (Reino Unido), $70-$105/h.
Especialista em Excel — Finanças
Profissionais de finanças com competências avançadas em Excel criam e avaliam tarefas de modelação em Excel para treinar modelos de IA de uma grande empresa tecnológica. Remoto EUA, $70-$100/h.
