AI Safety Practitioner
Sobre el Puesto
Buscamos AI Safety Practitioners con experiencia para evaluar la seguridad, calidad y alineación de modelos de IA de vanguardia en temas complejos, sensibles desde el punto de vista de las políticas y ambiguos ("zonas grises"). Evaluarás respuestas generadas por IA, aplicarás políticas de seguridad y ayudarás a mejorar el comportamiento de los modelos mediante evaluaciones estructuradas y retroalimentación.
Lo Que Harás
- Evaluar respuestas generadas por IA en cuanto a seguridad, precisión factual, cumplimiento de políticas y calidad general
- Revisar contenido relacionado con desinformación, persuasión política, autolesión, violencia, ciberseguridad, bioseguridad y otros dominios sensibles
- Aplicar y refinar rúbricas de evaluación para RLHF, SFT y benchmarking de seguridad de IA
- Identificar respuestas inseguras, alucinaciones, fallos de razonamiento y violaciones de políticas
- Proporcionar retroalimentación estructurada para mejorar la alineación y el desempeño de seguridad de los modelos
- Colaborar con investigadores de IA y equipos de seguridad en iniciativas continuas de evaluación
Requisitos
- Licenciatura o título superior en Periodismo, Comunicación, Psicología, Sociología, Políticas Públicas, Derecho, Biología, Química, Ciencias de la Computación o áreas afines
- 5+ años de experiencia profesional en Seguridad de IA, Trust & Safety, periodismo, políticas públicas, investigación científica, seguridad o campos relacionados
- Excelente inglés escrito, pensamiento crítico y capacidad de razonamiento analítico
- Capacidad para evaluar de forma consistente escenarios matizados y sensibles desde el punto de vista de las políticas
Cualificaciones Preferidas
- Experiencia con Seguridad de IA, RLHF, SFT, Trust & Safety o evaluación de IA
- Familiaridad con políticas de seguridad, moderación de contenido o desarrollo de rúbricas de evaluación
- Experiencia revisando contenido complejo, de alto riesgo o ambiguo
Por Qué Unirte
- Ayuda a definir la seguridad y el comportamiento de modelos de IA de vanguardia usados por millones de personas en todo el mundo
- Trabaja en evaluaciones de seguridad desafiantes y del mundo real, en dominios matizados y de alto impacto
- Colabora con investigadores, ingenieros y equipos de seguridad de IA de primer nivel
Compensación y Logística
- Tipo: Contratista independiente
- Compensación: Competitiva, pagada semanalmente vía Stripe o Wise
- Ubicación: Remoto
- Proceso de solicitud: Envía tu currículum o trayectoria profesional relevante. Los candidatos calificados podrán ser invitados a completar una breve evaluación o proporcionar información adicional. Las solicitudes se revisan de forma continua.
Empleos relacionados
Experto/a en Escritura
Aplica tu experiencia literaria — dramaturgia, ficción, periodismo, ensayos o redes sociales — a proyectos avanzados de entrenamiento de IA con laboratorios líderes. Trabajo remoto, flexible y por proyecto.
Diseñador/a de Sitios Web (Con Base en el Reino Unido) — Entrenamiento de IA
Aporta experiencia de primer nivel en diseño de sitios web a un proyecto de entrenamiento de IA de vanguardia — un puesto remoto, de horario flexible, para diseñadores con base en el Reino Unido, como contratista independiente, hasta 40 horas/semana.
Evaluador/a de Investigación de Usuarios/Clientes y Síntesis de Retroalimentación
Aplica tu experiencia en investigación de usuarios y clientes para evaluar productos de trabajo generados por IA en cuanto a precisión, rigor y calidad — un contrato remoto, por horas y flexible con Mercor.
