AI Safety Practitioner
Sobre a Vaga
Procuramos AI Safety Practitioners experientes para avaliar a segurança, qualidade e alinhamento de modelos de IA de ponta em temas complexos, sensíveis do ponto de vista das políticas e ambíguos ("zonas cinzentas"). Irá avaliar respostas geradas por IA, aplicar políticas de segurança e ajudar a melhorar o comportamento dos modelos através de avaliações estruturadas e feedback.
O Que Vai Fazer
- Avaliar respostas geradas por IA quanto à segurança, exatidão factual, conformidade com políticas e qualidade geral
- Rever conteúdos relacionados com desinformação, persuasão política, autolesão, violência, cibersegurança, biossegurança e outros domínios sensíveis
- Aplicar e refinar grelhas de avaliação para RLHF, SFT e benchmarking de segurança de IA
- Identificar respostas inseguras, alucinações, falhas de raciocínio e violações de políticas
- Fornecer feedback estruturado para melhorar o alinhamento e o desempenho de segurança dos modelos
- Colaborar com investigadores de IA e equipas de segurança em iniciativas contínuas de avaliação
Requisitos
- Licenciatura ou grau superior em Jornalismo, Comunicação, Psicologia, Sociologia, Políticas Públicas, Direito, Biologia, Química, Ciências da Computação ou área relacionada
- 5+ anos de experiência profissional em Segurança de IA, Trust & Safety, jornalismo, políticas públicas, investigação científica, segurança ou área relacionada
- Excelente inglês escrito, pensamento crítico e capacidade de raciocínio analítico
- Capacidade de avaliar de forma consistente cenários nuançados e sensíveis do ponto de vista das políticas
Qualificações Preferenciais
- Experiência com Segurança de IA, RLHF, SFT, Trust & Safety ou avaliação de IA
- Familiaridade com políticas de segurança, moderação de conteúdos ou desenvolvimento de grelhas de avaliação
- Experiência na revisão de conteúdos complexos, de alto risco ou ambíguos
Porquê Juntar-se
- Ajude a moldar a segurança e o comportamento de modelos de IA de ponta usados por milhões de pessoas em todo o mundo
- Trabalhe em avaliações de segurança desafiantes e do mundo real, em domínios nuançados e de elevado impacto
- Colabore com investigadores, engenheiros e equipas de segurança de IA de referência
Compensação e Logística
- Tipo: Contratante independente
- Compensação: Competitiva, paga semanalmente via Stripe ou Wise
- Localização: Remoto
- Candidatura: Envie o seu currículo ou percurso profissional relevante. Os candidatos qualificados poderão ser convidados a realizar uma breve avaliação ou a fornecer informação adicional. As candidaturas são analisadas de forma contínua.
Vagas relacionadas
Especialista em Escrita
Aplique a sua experiência literária — dramaturgia, ficção, jornalismo, ensaios ou redes sociais — a projetos avançados de treino de IA com laboratórios de referência mundial. Trabalho remoto, flexível e por projeto.
Designer de Website (Baseado(a) no Reino Unido) — Treino de IA
Contribua com experiência de topo em design de websites para um projeto de treino de IA de ponta — uma função remota, com horário flexível, para designers baseados no Reino Unido, como prestador de serviços independente, até 40 horas/semana.
Avaliador(a) de Investigação de Utilizadores/Clientes e Síntese de Feedback
Aplique a sua experiência em investigação de utilizadores e clientes na avaliação de produtos de trabalho gerados por IA quanto à precisão, rigor e qualidade — um contrato remoto, por hora e flexível com a Mercor.
