Member of Technical Staff, Research Engineering (M/F)
Informazioni sul ruolo
Titolo della posizione: Member of Technical Staff, Research Engineering Tipo di contratto: Tempo pieno Sede: Da remoto Cerchiamo un Research Engineer che operi all'avanguardia del Reinforcement Learning (RL), sviluppando nuovi ambienti, pipeline di addestramento e sistemi di valutazione che fanno progredire le capacità dei moderni modelli di IA. Il ruolo si colloca all'incrocio tra ricerca e produzione, traducendo idee sperimentali in sistemi scalabili e ad alte prestazioni.
Su cosa lavorerai
- Progettare l'architettura di ambienti RL autonomi che riproducano compiti complessi del mondo reale, comprese funzioni di ricompensa, verificatori e logica di valutazione.
- Progettare e scalare pipeline di episodi e processi di addestramento multicomponente (MCP) per supportare una sperimentazione riproducibile.
- Costruire sistemi automatizzati di generazione di dati, sfruttando dati sintetici per accelerare i cicli di addestramento senza compromettere la qualità.
- Sviluppare e integrare sistemi di valutazione e di assicurazione della qualità basati sull'IA per valutazione automatica, validazione e cicli di feedback.
- Eseguire il fine-tuning e ottimizzare modelli RL open source usando dataset generati internamente e strategie di addestramento personalizzate.
- Definire framework di benchmarking per misurare capacità, robustezza dei modelli e qualità dei dati sui diversi compiti.
- Contribuire alla pubblicazione e all'analisi di valutazioni su piattaforme di benchmark interne ed esterne (ad es. i benchmark di micro1).
Requisiti
- Solida esperienza di Reinforcement Learning, inclusa la progettazione di ambienti e le dinamiche di addestramento.
- Comprovata esperienza nella costruzione e nella scalabilità di sistemi RL, pipeline o framework di sperimentazione.
- Padronanza dell'automazione e della generazione di dati, comprese le pipeline di dati sintetici.
- Familiarità con sistemi di valutazione automatizzata, validazione dei modelli e workflow di assicurazione della qualità.
- Esperienza nel fine-tuning e nella valutazione di modelli di ML open source.
- Comunicatore chiaro e conciso, con solide capacità di scrittura tecnica.
- A proprio agio in ambienti dinamici, orientati alla ricerca e fortemente collaborativi.
Titoli preferenziali
- Esperienza nella pubblicazione di benchmark, valutazioni o artefatti di ricerca.
- Familiarità con gli ecosistemi di valutazione (ad es. i benchmark di micro1 o framework simili).
- Esperienza in infrastrutture scalabili per la sperimentazione RL su larga scala.
Compenso e modalità
La fascia retributiva nazionale per questa posizione a tempo pieno prevede una retribuzione base di 200.000 $–300.000 $ USD. Tutti i dipendenti hanno diritto a una remunerazione in equity e possono inoltre ricevere bonus legati alle prestazioni, in base al ruolo e nel rispetto delle policy aziendali. micro1 offre un pacchetto completo di benefit, tra cui il rimborso fino al 100% dei premi dell'assicurazione sanitaria, ferie retribuite, un piano 401(k) con contributo aziendale e ulteriori benefit pensati per sostenere una forza lavoro ad alte prestazioni, remote-first.
Ruoli correlati
Ingegnere IA/ML, piattaforme interne (M/F)
Ingegnere IA/ML, piattaforme interne — da remoto, lavoro retribuito di addestramento e valutazione dell'IA (ai-machine-learning) ($160-$300/h).
Ingegnere IA/ML (M/F)
Ingegnere IA/ML — lavoro retribuito da remoto di addestramento e valutazione dell'IA (IA e machine learning) ($70-$200/h).
Statistico (M/F)
Statistico — da remoto, lavoro retribuito di addestramento/valutazione dell'IA (scienze-ricerca) ($60-$120/h).
