Specialista di sicurezza dell'IA (M/F)
Informazioni sul ruolo
Cerchiamo specialisti esperti di sicurezza dell'IA per valutare la sicurezza, la qualità e l'allineamento dei modelli di IA all'avanguardia su temi complessi, sensibili dal punto di vista delle policy e ambigui (le cosiddette «zone grigie»). Valuterai le risposte generate dall'IA, applicherai le policy di sicurezza e contribuirai a migliorare il comportamento dei modelli attraverso valutazioni e feedback strutturati.
Cosa farai
- Valutare le risposte generate dall'IA in termini di sicurezza, accuratezza dei fatti, conformità alle policy e qualità complessiva
- Esaminare contenuti che riguardano disinformazione, persuasione politica, autolesionismo, violenza, cybersicurezza, biosicurezza e altri ambiti sensibili
- Applicare e perfezionare griglie di valutazione per RLHF, SFT e benchmark di sicurezza dell'IA
- Individuare output non sicuri, allucinazioni, errori di ragionamento e violazioni delle policy
- Fornire un feedback strutturato per migliorare l'allineamento e la sicurezza dei modelli
- Collaborare con ricercatori di IA e team di sicurezza su iniziative di valutazione in corso
Requisiti
- Laurea triennale o superiore in giornalismo, comunicazione, psicologia, sociologia, politiche pubbliche, giurisprudenza, biologia, chimica, informatica o in una disciplina affine
- Più di 5 anni di esperienza professionale in sicurezza dell'IA, Trust & Safety, giornalismo, politiche pubbliche, ricerca scientifica, sicurezza o in un campo affine
- Ottima scrittura in inglese, pensiero critico e capacità di ragionamento analitico
- Capacità di valutare in modo coerente scenari sfumati e sensibili dal punto di vista delle policy
Titoli preferenziali
- Esperienza in sicurezza dell'IA, RLHF, SFT, Trust & Safety o valutazione dell'IA
- Familiarità con le policy di sicurezza, la moderazione dei contenuti o lo sviluppo di griglie di valutazione
- Esperienza nella revisione di contenuti complessi, ad alto rischio o ambigui
Perché unirti a noi
- Contribuisci a definire la sicurezza e il comportamento dei modelli di IA all'avanguardia usati da milioni di persone nel mondo
- Lavora a valutazioni di sicurezza impegnative e concrete in ambiti sfumati e ad alto impatto
- Collabora con importanti ricercatori di IA, ingegneri e team di sicurezza
Compenso e modalità
- Tipo: collaboratore indipendente
- Compenso: competitivo, pagato ogni settimana tramite Stripe o Wise
- Località: da remoto
- Candidatura: invia il tuo CV o il tuo background professionale pertinente. I candidati idonei potrebbero essere invitati a completare una breve valutazione o a fornire ulteriori informazioni. Le candidature vengono esaminate su base continuativa.
Ruoli correlati
Red Teamer per la sicurezza dell'IA (M/F)
Individua le vulnerabilità dei sistemi di IA all'avanguardia attraverso test avversariali, come collaboratore indipendente con pagamento settimanale.
Break-It-To-Build-It — Tester hardware (M/F)
Break-It-To-Build-It — Tester hardware — da remoto, lavoro retribuito di addestramento e valutazione dell'IA (robotica) ($10-$20/h).
Esperto UX/UI Designer (M/F)
Progetta criteri di valutazione e assegna punteggi a lavori di prodotto digitale e UX generati dall'IA — design system, flussi, dashboard — $80–$150/h, completamente da remoto.
