Membre de l'équipe technique, ingénierie de recherche (H/F)
À propos du poste
Intitulé du poste : Membre de l'équipe technique, ingénierie de recherche Type de contrat : Temps plein Lieu : À distance Nous recherchons un ingénieur de recherche pour travailler à la pointe de l'apprentissage par renforcement (RL), en développant de nouveaux environnements, des pipelines d'entraînement et des systèmes d'évaluation qui font progresser les capacités des modèles d'IA modernes. Ce poste se situe à l'interface de la recherche et de la production : il s'agit de transformer des idées expérimentales en systèmes évolutifs et performants.
Vos axes de travail
- Concevoir l'architecture d'environnements RL autonomes qui reproduisent des tâches complexes du monde réel, y compris les fonctions de récompense, les vérificateurs et la logique d'évaluation.
- Concevoir et faire évoluer des pipelines d'épisodes et des processus d'entraînement multicomposants (MCP) pour permettre une expérimentation reproductible.
- Construire des systèmes automatisés de génération de données, en s'appuyant sur des données synthétiques pour accélérer les cycles d'entraînement sans compromettre la qualité.
- Développer et intégrer des systèmes d'évaluation et d'assurance qualité pilotés par l'IA pour la notation automatisée, la validation et les boucles de rétroaction.
- Affiner (fine-tuning) et optimiser des modèles RL open source à partir de jeux de données générés en interne et de stratégies d'entraînement sur mesure.
- Mettre en place des cadres de benchmarking pour mesurer les capacités, la robustesse des modèles et la qualité des données selon les tâches.
- Contribuer à la publication et à l'analyse d'évaluations sur des plateformes de benchmarks internes et externes (par ex. les benchmarks de micro1).
Profil recherché
- Solide expérience de l'apprentissage par renforcement, y compris la conception d'environnements et la dynamique d'entraînement.
- Parcours avéré dans la construction et le passage à l'échelle de systèmes, de pipelines ou de cadres d'expérimentation RL.
- Maîtrise de l'automatisation et de la génération de données, y compris les pipelines de données synthétiques.
- Familiarité avec les systèmes d'évaluation automatisée, la validation de modèles et les workflows d'assurance qualité.
- Expérience du fine-tuning et de l'évaluation de modèles de ML open source.
- Communicant clair et concis, doté de solides compétences en rédaction technique.
- À l'aise dans des environnements dynamiques, orientés recherche et fortement collaboratifs.
Atouts
- Expérience de la publication de benchmarks, d'évaluations ou d'artefacts de recherche.
- Familiarité avec les écosystèmes d'évaluation (par ex. les benchmarks de micro1 ou des cadres similaires).
- Expérience en infrastructure évolutive pour l'expérimentation RL à grande échelle.
Rémunération et modalités
La fourchette salariale nationale pour ce poste à temps plein correspond à un salaire de base de 200 000 $ à 300 000 $ USD. Tous les employés sont éligibles à une rémunération en actions, et peuvent également recevoir des primes liées à la performance, selon le poste et sous réserve des politiques de l'entreprise. micro1 propose un ensemble complet d'avantages, notamment un remboursement allant jusqu'à 100 % des primes d'assurance santé, des congés payés, un plan 401(k) avec contribution de l'employeur et d'autres avantages conçus pour soutenir des équipes très performantes, en télétravail par défaut.
Postes similaires
Ingénieur IA/ML, plateformes internes (H/F)
Ingénieur IA/ML, plateformes internes — à distance, travail rémunéré d'entraînement et d'évaluation d'IA (ai-machine-learning) ($160-$300/h).
Ingénieur IA/ML (H/F)
Ingénieur IA/ML — travail rémunéré à distance d'entraînement et d'évaluation d'IA (IA et machine learning) ($70-$200/h).
Statisticien (H/F)
Statisticien — à distance, travail rémunéré d'entraînement/évaluation d'IA (sciences-recherche) ($60-$120/h).
