Red Teamer per la sicurezza dell'IA (M/F)
Informazioni sul ruolo
Cerchiamo Red Teamer esperti di sicurezza dell'IA per individuare le vulnerabilità dei sistemi di IA all'avanguardia attraverso test avversariali. Progetterai prompt impegnativi, farai emergere i punti deboli dei modelli e valuterai il comportamento dell'IA su temi complessi, ad alto rischio e ambigui (le cosiddette «zone grigie»).
Cosa farai
- Progettare prompt avversariali per mettere alla prova i modelli di IA all'avanguardia
- Individuare jailbreak, comportamenti non sicuri, allucinazioni e violazioni delle policy
- Valutare la robustezza dei modelli su disinformazione, cybersicurezza, biosicurezza, frodi, contenuti politici e altri ambiti sensibili
- Documentare le vulnerabilità e contribuire a benchmark di sicurezza e report di red teaming
- Collaborare con i ricercatori di IA per migliorare l'allineamento, la robustezza e la sicurezza dei modelli
Requisiti
- Laurea triennale o superiore in informatica, cybersicurezza, giornalismo, comunicazione, psicologia, biologia, chimica, politiche pubbliche o in una disciplina affine
- Più di 5 anni di esperienza professionale in sicurezza dell'IA, red teaming dell'IA, Trust & Safety, cybersicurezza, giornalismo investigativo, scienze della vita o in un campo affine
- Solide capacità di ragionamento analitico, di progettazione di prompt e di comunicazione scritta
- Esperienza nella progettazione di prompt avversariali o nella valutazione di sistemi di IA all'avanguardia
Titoli preferenziali
- Esperienza di red teaming dell'IA, RLHF, SFT, allineamento dell'IA o Trust & Safety
- Familiarità con i test di jailbreak, il prompt engineering o le metodologie di valutazione avversariale
- Competenza in uno o più ambiti di zona grigia, tra cui cybersicurezza, biosicurezza, contenuti politici, disinformazione o sicurezza scientifica
Perché unirti a noi
- Contribuisci a mettere in sicurezza e a rafforzare la prossima generazione di modelli di IA all'avanguardia
- Lavora a test avversariali all'avanguardia insieme a importanti ricercatori di IA e team di sicurezza
- Influenza il modo in cui i sistemi di IA rispondono a sfide di sicurezza complesse e reali
Compenso e modalità
- Tipo: collaboratore indipendente
- Compenso: competitivo, pagato ogni settimana tramite Stripe o Wise
- Località: da remoto
- Candidatura: invia il tuo CV o il tuo background professionale pertinente. I candidati idonei potrebbero essere invitati a completare una breve valutazione o a fornire ulteriori informazioni. Le candidature vengono esaminate su base continuativa.
Ruoli correlati
Revisore di sicurezza antincendio e tutela delle persone — Vulcan (M/F)
Mercor assume revisori di progetti antincendio con sede negli Stati Uniti per scrivere e verificare compiti di revisione normativa per la valutazione dell'IA. Da remoto (USA), $45-$60/h, circa 40 ore a settimana.
Sicurezza chimica per il red teaming (M/F)
Mercor assume esperti di chimica per fare red teaming su modelli di IA di frontiera scrivendo e giudicando prompt benigni, a duplice uso e avversariali. Da remoto, $65-$75 a compito.
Esperto di materiali energetici per il red teaming (M/F)
Mercor sta formando un panel di esperti di esplosivi e materiali energetici per fare red teaming su modelli di IA di frontiera scrivendo e valutando prompt. Da remoto, $65-$75 a compito.
