Volver a todos los empleos
Mercor

AI Safety Red Teamer

Ubicación: RemoteTipo de contrato: ContratoPublicado: 28 de julio de 2026

Sobre el Puesto

Buscamos AI Safety Red Teamers con experiencia para identificar vulnerabilidades en sistemas de IA de vanguardia mediante pruebas adversariales. Diseñarás prompts desafiantes, descubrirás debilidades de los modelos y evaluarás el comportamiento de la IA en temas complejos, de alto riesgo y ambiguos ("zonas grises").

Lo Que Harás

  • Diseñar prompts adversariales para poner a prueba modelos de IA de vanguardia
  • Identificar jailbreaks, comportamientos inseguros, alucinaciones y fallos de política
  • Evaluar la robustez de los modelos frente a desinformación, ciberseguridad, bioseguridad, fraude, contenido político y otros dominios sensibles
  • Documentar vulnerabilidades y contribuir a informes de benchmarking de seguridad y red-teaming
  • Colaborar con investigadores de IA para mejorar la alineación, robustez y seguridad de los modelos

Requisitos

  • Licenciatura o título superior en Ciencias de la Computación, Ciberseguridad, Periodismo, Comunicación, Psicología, Biología, Química, Políticas Públicas o áreas afines
  • 5+ años de experiencia profesional en Seguridad de IA, AI Red Teaming, Trust & Safety, ciberseguridad, periodismo de investigación, ciencias de la vida o campos relacionados
  • Sólido razonamiento analítico, diseño de prompts y habilidades de comunicación escrita
  • Experiencia diseñando prompts adversariales o evaluando sistemas de IA de vanguardia

Cualificaciones Preferidas

  • Experiencia con AI Red Teaming, RLHF, SFT, Alineación de IA o Trust & Safety
  • Familiaridad con pruebas de jailbreak, ingeniería de prompts o metodologías de evaluación adversarial
  • Experiencia en uno o más dominios grises, incluyendo ciberseguridad, bioseguridad, contenido político, desinformación o seguridad científica

Por Qué Unirte

  • Ayuda a proteger y fortalecer la próxima generación de modelos de IA de vanguardia
  • Trabaja en pruebas adversariales de vanguardia junto a investigadores de IA y equipos de seguridad de primer nivel
  • Influye en cómo los sistemas de IA responden a desafíos de seguridad complejos del mundo real

Compensación y Logística

  • Tipo: Contratista independiente
  • Compensación: Competitiva, pagada semanalmente vía Stripe o Wise
  • Ubicación: Remoto
  • Proceso de solicitud: Envía tu currículum o trayectoria profesional relevante. Los candidatos calificados podrán ser invitados a completar una breve evaluación o proporcionar información adicional. Las solicitudes se revisan de forma continua.