Voltar a todas as vagas
Mercor

AI Safety Practitioner

Localização: RemoteTipo de contrato: ContratoPublicada em: 28 de julho de 2026

Sobre a Vaga

Procuramos AI Safety Practitioners experientes para avaliar a segurança, qualidade e alinhamento de modelos de IA de ponta em temas complexos, sensíveis do ponto de vista das políticas e ambíguos ("zonas cinzentas"). Irá avaliar respostas geradas por IA, aplicar políticas de segurança e ajudar a melhorar o comportamento dos modelos através de avaliações estruturadas e feedback.

O Que Vai Fazer

  • Avaliar respostas geradas por IA quanto à segurança, exatidão factual, conformidade com políticas e qualidade geral
  • Rever conteúdos relacionados com desinformação, persuasão política, autolesão, violência, cibersegurança, biossegurança e outros domínios sensíveis
  • Aplicar e refinar grelhas de avaliação para RLHF, SFT e benchmarking de segurança de IA
  • Identificar respostas inseguras, alucinações, falhas de raciocínio e violações de políticas
  • Fornecer feedback estruturado para melhorar o alinhamento e o desempenho de segurança dos modelos
  • Colaborar com investigadores de IA e equipas de segurança em iniciativas contínuas de avaliação

Requisitos

  • Licenciatura ou grau superior em Jornalismo, Comunicação, Psicologia, Sociologia, Políticas Públicas, Direito, Biologia, Química, Ciências da Computação ou área relacionada
  • 5+ anos de experiência profissional em Segurança de IA, Trust & Safety, jornalismo, políticas públicas, investigação científica, segurança ou área relacionada
  • Excelente inglês escrito, pensamento crítico e capacidade de raciocínio analítico
  • Capacidade de avaliar de forma consistente cenários nuançados e sensíveis do ponto de vista das políticas

Qualificações Preferenciais

  • Experiência com Segurança de IA, RLHF, SFT, Trust & Safety ou avaliação de IA
  • Familiaridade com políticas de segurança, moderação de conteúdos ou desenvolvimento de grelhas de avaliação
  • Experiência na revisão de conteúdos complexos, de alto risco ou ambíguos

Porquê Juntar-se

  • Ajude a moldar a segurança e o comportamento de modelos de IA de ponta usados por milhões de pessoas em todo o mundo
  • Trabalhe em avaliações de segurança desafiantes e do mundo real, em domínios nuançados e de elevado impacto
  • Colabore com investigadores, engenheiros e equipas de segurança de IA de referência

Compensação e Logística

  • Tipo: Contratante independente
  • Compensação: Competitiva, paga semanalmente via Stripe ou Wise
  • Localização: Remoto
  • Candidatura: Envie o seu currículo ou percurso profissional relevante. Os candidatos qualificados poderão ser convidados a realizar uma breve avaliação ou a fornecer informação adicional. As candidaturas são analisadas de forma contínua.