Red Teamer en sécurité de l'IA (H/F)
À propos du poste
Nous recherchons des red teamers en sécurité de l'IA expérimentés pour identifier les vulnérabilités des systèmes d'IA de pointe grâce à des tests adverses. Vous concevrez des prompts exigeants, mettrez au jour les faiblesses des modèles et évaluerez le comportement de l'IA sur des sujets complexes, à haut risque et ambigus (« zones grises »).
Vos missions
- Concevoir des prompts adverses pour éprouver les modèles d'IA de pointe
- Identifier les jailbreaks, les comportements dangereux, les hallucinations et les manquements aux politiques
- Évaluer la robustesse des modèles face à la désinformation, à la cybersécurité, à la biosécurité, à la fraude, aux contenus politiques et à d'autres domaines sensibles
- Documenter les vulnérabilités et contribuer aux évaluations comparatives de sécurité et aux rapports de red teaming
- Collaborer avec des chercheurs en IA pour améliorer l'alignement, la robustesse et la sécurité des modèles
Profil recherché
- Diplôme de niveau Licence ou supérieur en informatique, cybersécurité, journalisme, communication, psychologie, biologie, chimie, politiques publiques ou dans une discipline connexe
- Plus de 5 ans d'expérience professionnelle en sécurité de l'IA, red teaming de l'IA, Trust & Safety, cybersécurité, journalisme d'investigation, sciences de la vie ou dans un domaine connexe
- Solides compétences en raisonnement analytique, en conception de prompts et en communication écrite
- Expérience de la conception de prompts adverses ou de l'évaluation de systèmes d'IA de pointe
Atouts appréciés
- Expérience en red teaming de l'IA, RLHF, SFT, alignement de l'IA ou Trust & Safety
- Connaissance des tests de jailbreak, de l'ingénierie de prompts ou des méthodologies d'évaluation adverse
- Expertise dans un ou plusieurs domaines de zone grise, notamment la cybersécurité, la biosécurité, les contenus politiques, la désinformation ou la sécurité scientifique
Pourquoi nous rejoindre
- Contribuer à sécuriser et à renforcer la prochaine génération de modèles d'IA de pointe
- Travailler sur des tests adverses de pointe aux côtés de chercheurs en IA et d'équipes de sécurité de premier plan
- Influencer la manière dont les systèmes d'IA répondent à des défis de sécurité complexes et réels
Rémunération et modalités
- Type : prestataire indépendant
- Rémunération : compétitive, versée chaque semaine via Stripe ou Wise
- Lieu : à distance
- Candidature : envoyez votre CV ou votre parcours professionnel pertinent. Les candidats qualifiés pourront être invités à passer une brève évaluation ou à fournir des informations complémentaires. Les candidatures sont examinées au fil de l'eau.
Postes similaires
Spécialiste en sécurité de l'IA (H/F)
Contribuez à évaluer la sécurité, la qualité et l'alignement de modèles d'IA de pointe sur des sujets complexes et sensibles sur le plan des politiques, en tant que prestataire indépendant rémunéré chaque semaine.
Break-It-To-Build-It — Testeur matériel (H/F)
Break-It-To-Build-It — Testeur matériel — à distance, travail rémunéré d'entraînement et d'évaluation d'IA (robotique) ($10-$20/h).
Expert designer UX/UI (H/F)
Concevez des critères d'évaluation et notez des productions UX et de produits numériques générées par l'IA (design systems, parcours, tableaux de bord) — $80–$150/h, entièrement à distance.
