Expert en matériaux énergétiques pour le red teaming (H/F)
À propos du poste
Mercor constitue un panel d'experts en explosifs et matériaux énergétiques pour faire du red teaming sur des modèles d'IA de pointe. L'objectif est de vérifier si un modèle juge correctement le potentiel de détournement : répondre pleinement aux questions légitimes tout en refusant celles qui sont réellement dangereuses. Les modèles se trompent dans les deux sens, ce qu'il faut une véritable expérience de terrain pour repérer.
Vos missions
- Rédiger des prompts exigeants à un seul tour, étiquetés comme bénins, à double usage ou adversariaux
- Évaluer les réponses des modèles selon une norme de politique définie et juger si chacune a été traitée correctement
- Rédiger la réponse de référence et le raisonnement technique qui la sous-tend
- Fournir pour chaque jugement une justification écrite qu'un non-spécialiste puisse suivre
Profil recherché
- Chimistes disposant d'une expertise en matériaux spéciaux, ou ingénieurs et opérateurs ayant une expérience de l'amorçage et de la propulsion
- Parcours pertinents : spécialiste des dispositifs dangereux, chimiste en pyrotechnie ou en propulsion, spécialiste médico-légal des matériaux, ingénieur en propulsion et effets, ingénieur en abattage à l'explosif commercial
- Expérience préalable en évaluation d'IA ou en red teaming appréciée
- Solides compétences de rédaction technique ; un échantillon ou un lien est encouragé
- Le travail ne doit pas impliquer d'informations classifiées, soumises au contrôle des exportations, couvertes par un NDA ou soumises à des restrictions de prépublication
Rémunération et modalités
- Rémunération : $65-$75 par tâche
- À distance, aucune restriction géographique indiquée
- Implique une lecture et une rédaction prolongées sur des scénarios de détournement ; les experts sont informés au préalable et peuvent faire une pause à tout moment
Postes similaires
Réviseur sécurité incendie et protection des personnes — Vulcan (H/F)
Mercor recrute des réviseurs de plans de sécurité incendie basés aux États-Unis pour rédiger et vérifier des tâches de contrôle réglementaire destinées à l'évaluation d'IA. À distance (États-Unis), $45-$60/h, environ 40 heures par semaine.
Red Teamer en sécurité de l'IA (H/F)
Identifiez les vulnérabilités des systèmes d'IA de pointe grâce à des tests adverses, en tant que prestataire indépendant rémunéré chaque semaine.
Spécialiste en sécurité de l'IA (H/F)
Contribuez à évaluer la sécurité, la qualité et l'alignement de modèles d'IA de pointe sur des sujets complexes et sensibles sur le plan des politiques, en tant que prestataire indépendant rémunéré chaque semaine.
