← Torna a tutti i lavori

Member of Technical Staff, Research Engineering (M/F)

Località: Da remotoLocalità idonee: In tutto il mondoTipo di contratto: ContrattoCompenso: $7 – $8Pubblicato: 29 settembre 2026

Informazioni sul ruolo

Titolo della posizione: Member of Technical Staff, Research Engineering Tipo di contratto: Tempo pieno Sede: Da remoto Cerchiamo un Research Engineer che operi all'avanguardia del Reinforcement Learning (RL), sviluppando nuovi ambienti, pipeline di addestramento e sistemi di valutazione che fanno progredire le capacità dei moderni modelli di IA. Il ruolo si colloca all'incrocio tra ricerca e produzione, traducendo idee sperimentali in sistemi scalabili e ad alte prestazioni.

Su cosa lavorerai

  • Progettare l'architettura di ambienti RL autonomi che riproducano compiti complessi del mondo reale, comprese funzioni di ricompensa, verificatori e logica di valutazione.
  • Progettare e scalare pipeline di episodi e processi di addestramento multicomponente (MCP) per supportare una sperimentazione riproducibile.
  • Costruire sistemi automatizzati di generazione di dati, sfruttando dati sintetici per accelerare i cicli di addestramento senza compromettere la qualità.
  • Sviluppare e integrare sistemi di valutazione e di assicurazione della qualità basati sull'IA per valutazione automatica, validazione e cicli di feedback.
  • Eseguire il fine-tuning e ottimizzare modelli RL open source usando dataset generati internamente e strategie di addestramento personalizzate.
  • Definire framework di benchmarking per misurare capacità, robustezza dei modelli e qualità dei dati sui diversi compiti.
  • Contribuire alla pubblicazione e all'analisi di valutazioni su piattaforme di benchmark interne ed esterne (ad es. i benchmark di micro1).

Requisiti

  • Solida esperienza di Reinforcement Learning, inclusa la progettazione di ambienti e le dinamiche di addestramento.
  • Comprovata esperienza nella costruzione e nella scalabilità di sistemi RL, pipeline o framework di sperimentazione.
  • Padronanza dell'automazione e della generazione di dati, comprese le pipeline di dati sintetici.
  • Familiarità con sistemi di valutazione automatizzata, validazione dei modelli e workflow di assicurazione della qualità.
  • Esperienza nel fine-tuning e nella valutazione di modelli di ML open source.
  • Comunicatore chiaro e conciso, con solide capacità di scrittura tecnica.
  • A proprio agio in ambienti dinamici, orientati alla ricerca e fortemente collaborativi.

Titoli preferenziali

  • Esperienza nella pubblicazione di benchmark, valutazioni o artefatti di ricerca.
  • Familiarità con gli ecosistemi di valutazione (ad es. i benchmark di micro1 o framework simili).
  • Esperienza in infrastrutture scalabili per la sperimentazione RL su larga scala.

Compenso e modalità

La fascia retributiva nazionale per questa posizione a tempo pieno prevede una retribuzione base di 200.000 $–300.000 $ USD. Tutti i dipendenti hanno diritto a una remunerazione in equity e possono inoltre ricevere bonus legati alle prestazioni, in base al ruolo e nel rispetto delle policy aziendali. micro1 offre un pacchetto completo di benefit, tra cui il rimborso fino al 100% dei premi dell'assicurazione sanitaria, ferie retribuite, un piano 401(k) con contributo aziendale e ulteriori benefit pensati per sostenere una forza lavoro ad alte prestazioni, remote-first.