Volver a todos los empleos
Mercor

AI Safety Practitioner

Ubicación: RemoteTipo de contrato: ContratoPublicado: 28 de julio de 2026

Sobre el Puesto

Buscamos AI Safety Practitioners con experiencia para evaluar la seguridad, calidad y alineación de modelos de IA de vanguardia en temas complejos, sensibles desde el punto de vista de las políticas y ambiguos ("zonas grises"). Evaluarás respuestas generadas por IA, aplicarás políticas de seguridad y ayudarás a mejorar el comportamiento de los modelos mediante evaluaciones estructuradas y retroalimentación.

Lo Que Harás

  • Evaluar respuestas generadas por IA en cuanto a seguridad, precisión factual, cumplimiento de políticas y calidad general
  • Revisar contenido relacionado con desinformación, persuasión política, autolesión, violencia, ciberseguridad, bioseguridad y otros dominios sensibles
  • Aplicar y refinar rúbricas de evaluación para RLHF, SFT y benchmarking de seguridad de IA
  • Identificar respuestas inseguras, alucinaciones, fallos de razonamiento y violaciones de políticas
  • Proporcionar retroalimentación estructurada para mejorar la alineación y el desempeño de seguridad de los modelos
  • Colaborar con investigadores de IA y equipos de seguridad en iniciativas continuas de evaluación

Requisitos

  • Licenciatura o título superior en Periodismo, Comunicación, Psicología, Sociología, Políticas Públicas, Derecho, Biología, Química, Ciencias de la Computación o áreas afines
  • 5+ años de experiencia profesional en Seguridad de IA, Trust & Safety, periodismo, políticas públicas, investigación científica, seguridad o campos relacionados
  • Excelente inglés escrito, pensamiento crítico y capacidad de razonamiento analítico
  • Capacidad para evaluar de forma consistente escenarios matizados y sensibles desde el punto de vista de las políticas

Cualificaciones Preferidas

  • Experiencia con Seguridad de IA, RLHF, SFT, Trust & Safety o evaluación de IA
  • Familiaridad con políticas de seguridad, moderación de contenido o desarrollo de rúbricas de evaluación
  • Experiencia revisando contenido complejo, de alto riesgo o ambiguo

Por Qué Unirte

  • Ayuda a definir la seguridad y el comportamiento de modelos de IA de vanguardia usados por millones de personas en todo el mundo
  • Trabaja en evaluaciones de seguridad desafiantes y del mundo real, en dominios matizados y de alto impacto
  • Colabora con investigadores, ingenieros y equipos de seguridad de IA de primer nivel

Compensación y Logística

  • Tipo: Contratista independiente
  • Compensación: Competitiva, pagada semanalmente vía Stripe o Wise
  • Ubicación: Remoto
  • Proceso de solicitud: Envía tu currículum o trayectoria profesional relevante. Los candidatos calificados podrán ser invitados a completar una breve evaluación o proporcionar información adicional. Las solicitudes se revisan de forma continua.