← Zurück zu allen Jobs

Member of Technical Staff, Research Engineering (m/w/d)

Standort: RemoteZulässige Standorte: WeltweitVertragsart: VertragVergütung: $7 – $8Veröffentlicht: 29. September 2026

Über die Rolle

Stellenbezeichnung: Member of Technical Staff, Research Engineering Vertragsart: Vollzeit Standort: Remote Wir suchen einen Research Engineer, der an der Spitze des Reinforcement Learning (RL) arbeitet und neuartige Umgebungen, Trainingspipelines und Bewertungssysteme entwickelt, die die Fähigkeiten moderner KI-Modelle voranbringen. Die Rolle liegt an der Schnittstelle zwischen Forschung und Produktion und übersetzt experimentelle Ideen in skalierbare, leistungsstarke Systeme.

Woran Sie arbeiten werden

  • Eigenständige RL-Umgebungen entwerfen, die komplexe, reale Aufgaben abbilden, einschließlich Belohnungsfunktionen, Verifizierern und Bewertungslogik.
  • Episoden-Pipelines und mehrkomponentige Trainingsprozesse (MCPs) entwerfen und skalieren, um reproduzierbare Experimente zu ermöglichen.
  • Automatisierte Systeme zur Datengenerierung aufbauen und dabei synthetische Daten nutzen, um Trainingszyklen ohne Qualitätseinbußen zu beschleunigen.
  • KI-gestützte Bewertungs- und Qualitätssicherungssysteme für automatisierte Benotung, Validierung und Feedbackschleifen entwickeln und integrieren.
  • Open-Source-RL-Modelle mit intern generierten Datensätzen und individuellen Trainingsstrategien feinabstimmen (Fine-Tuning) und optimieren.
  • Benchmarking-Frameworks etablieren, um Modellfähigkeiten, Robustheit und Datenqualität über Aufgaben hinweg zu messen.
  • Zur Veröffentlichung und Analyse von Bewertungen auf internen und externen Benchmark-Plattformen beitragen (z. B. micro1-Benchmarks).

Anforderungen

  • Fundierte Erfahrung im Reinforcement Learning, einschließlich Umgebungsdesign und Trainingsdynamik.
  • Nachweisliche Erfahrung im Aufbau und in der Skalierung von RL-Systemen, Pipelines oder Experimentier-Frameworks.
  • Versiert in Automatisierung und Datengenerierung, einschließlich Pipelines für synthetische Daten.
  • Vertraut mit automatisierten Bewertungssystemen, Modellvalidierung und Workflows der Qualitätssicherung.
  • Erfahren im Fine-Tuning und in der Bewertung von Open-Source-ML-Modellen.
  • Klarer, prägnanter Kommunikator mit ausgeprägten Fähigkeiten im technischen Schreiben.
  • Fühlt sich in schnelllebigen, forschungsgetriebenen und stark kollaborativen Umgebungen wohl.

Von Vorteil

  • Erfahrung mit der Veröffentlichung von Benchmarks, Bewertungen oder Forschungsartefakten.
  • Vertrautheit mit Bewertungs-Ökosystemen (z. B. micro1-Benchmarks oder ähnlichen Frameworks).
  • Hintergrund in skalierbarer Infrastruktur für groß angelegte RL-Experimente.

Vergütung und Rahmenbedingungen

Die landesweite Gehaltsspanne für diese Vollzeitstelle beträgt ein Grundgehalt von 200.000 $ bis 300.000 $ USD. Alle Mitarbeitenden haben Anspruch auf Aktienbeteiligungen und können je nach Rolle und vorbehaltlich der Unternehmensrichtlinien zusätzlich leistungsabhängige Boni erhalten. micro1 bietet ein umfassendes Leistungspaket, darunter eine Erstattung von bis zu 100 % der Krankenversicherungsbeiträge, bezahlten Urlaub, einen 401(k)-Plan mit Arbeitgeberzuschuss und weitere Leistungen, die eine leistungsstarke, Remote-First-Belegschaft unterstützen sollen.