Member of Technical Staff, Research Engineering (m/w/d)
Über die Rolle
Stellenbezeichnung: Member of Technical Staff, Research Engineering Vertragsart: Vollzeit Standort: Remote Wir suchen einen Research Engineer, der an der Spitze des Reinforcement Learning (RL) arbeitet und neuartige Umgebungen, Trainingspipelines und Bewertungssysteme entwickelt, die die Fähigkeiten moderner KI-Modelle voranbringen. Die Rolle liegt an der Schnittstelle zwischen Forschung und Produktion und übersetzt experimentelle Ideen in skalierbare, leistungsstarke Systeme.
Woran Sie arbeiten werden
- Eigenständige RL-Umgebungen entwerfen, die komplexe, reale Aufgaben abbilden, einschließlich Belohnungsfunktionen, Verifizierern und Bewertungslogik.
- Episoden-Pipelines und mehrkomponentige Trainingsprozesse (MCPs) entwerfen und skalieren, um reproduzierbare Experimente zu ermöglichen.
- Automatisierte Systeme zur Datengenerierung aufbauen und dabei synthetische Daten nutzen, um Trainingszyklen ohne Qualitätseinbußen zu beschleunigen.
- KI-gestützte Bewertungs- und Qualitätssicherungssysteme für automatisierte Benotung, Validierung und Feedbackschleifen entwickeln und integrieren.
- Open-Source-RL-Modelle mit intern generierten Datensätzen und individuellen Trainingsstrategien feinabstimmen (Fine-Tuning) und optimieren.
- Benchmarking-Frameworks etablieren, um Modellfähigkeiten, Robustheit und Datenqualität über Aufgaben hinweg zu messen.
- Zur Veröffentlichung und Analyse von Bewertungen auf internen und externen Benchmark-Plattformen beitragen (z. B. micro1-Benchmarks).
Anforderungen
- Fundierte Erfahrung im Reinforcement Learning, einschließlich Umgebungsdesign und Trainingsdynamik.
- Nachweisliche Erfahrung im Aufbau und in der Skalierung von RL-Systemen, Pipelines oder Experimentier-Frameworks.
- Versiert in Automatisierung und Datengenerierung, einschließlich Pipelines für synthetische Daten.
- Vertraut mit automatisierten Bewertungssystemen, Modellvalidierung und Workflows der Qualitätssicherung.
- Erfahren im Fine-Tuning und in der Bewertung von Open-Source-ML-Modellen.
- Klarer, prägnanter Kommunikator mit ausgeprägten Fähigkeiten im technischen Schreiben.
- Fühlt sich in schnelllebigen, forschungsgetriebenen und stark kollaborativen Umgebungen wohl.
Von Vorteil
- Erfahrung mit der Veröffentlichung von Benchmarks, Bewertungen oder Forschungsartefakten.
- Vertrautheit mit Bewertungs-Ökosystemen (z. B. micro1-Benchmarks oder ähnlichen Frameworks).
- Hintergrund in skalierbarer Infrastruktur für groß angelegte RL-Experimente.
Vergütung und Rahmenbedingungen
Die landesweite Gehaltsspanne für diese Vollzeitstelle beträgt ein Grundgehalt von 200.000 $ bis 300.000 $ USD. Alle Mitarbeitenden haben Anspruch auf Aktienbeteiligungen und können je nach Rolle und vorbehaltlich der Unternehmensrichtlinien zusätzlich leistungsabhängige Boni erhalten. micro1 bietet ein umfassendes Leistungspaket, darunter eine Erstattung von bis zu 100 % der Krankenversicherungsbeiträge, bezahlten Urlaub, einen 401(k)-Plan mit Arbeitgeberzuschuss und weitere Leistungen, die eine leistungsstarke, Remote-First-Belegschaft unterstützen sollen.
Ähnliche Rollen
Bildanalyst – KI-/ML-Trainingsdaten (m/w/d)
Bounding Boxes auf Drohnen- und Marinesensorbildern annotieren und verfeinern, für KI-Training. Remote, USA-Wohnsitz, Teil- oder Vollzeit, $20-$60/Std.
Senior Data Analyst (m/w/d)
Teilzeitrolle für in den USA ansässige Senior Data Analysts, die Daten auf PII prüfen und KI-Antworten bei Geschäftsdatenaufgaben bewerten. Remote, nur USA, $50-$80/Std.
KI/ML-Ingenieur, interne Plattformen (m/w/d)
KI/ML-Ingenieur, interne Plattformen — remote, bezahlte Arbeit im KI-Training und in der KI-Bewertung (ai-machine-learning) ($160-$300/Std.).
