Chemikaliensicherheit für Red Teaming (m/w/d)
Über die Rolle
Mercor baut ein Panel aus Fachexperten der Chemie auf, um Spitzen-KI-Modelle per Red Teaming zu testen. Ziel ist es zu prüfen, ob ein Modell korrekt beurteilen kann, wie missbrauchsanfällig eine technische Anfrage ist: legitime Fragen vollständig beantworten, wirklich gefährliche aber ablehnen. Kalibrierung ist wichtiger als reine Schwierigkeit, denn ein fälschlich abgelehnter harmloser Prompt ist ebenso aufschlussreich wie ein fälschlich beantworteter adversarialer.
Ihre Aufgaben
- Anspruchsvolle Single-Turn-Prompts zur Chemie schreiben, die als harmlos, Dual-Use oder adversarial gekennzeichnet sind
- Beurteilen, ob jede Modellantwort anhand eines definierten Richtlinienstandards korrekt behandelt wurde
- Für jeden Prompt die Referenzantwort schreiben, einschließlich der dahinterstehenden technischen Begründung
- Schriftliche Begründungen liefern, die auch Nichtspezialisten nachvollziehen können
Anforderungen
- Praktische Erfahrung in Synthese, analytischer Chemie oder Chemikaliensicherheit (zum Beispiel chemische Verteidigungsforschung, Prozess- oder Synthesechemie, analytische oder forensische/toxikologische Chemie, Arbeitshygiene oder Prozesssicherheit)
- Starkes technisches Schreiben; veröffentlichte Forschung oder Erfahrung als Sachverständiger ist von Vorteil (Probe oder Link beifügen)
- Frühere Erfahrung mit KI-Bewertung oder Red Teaming bevorzugt, aber nicht erforderlich
- Bereitschaft, über längere Zeit über Missbrauchsszenarien zu lesen und zu schreiben; Sie können jederzeit ohne Nachteile pausieren
- Ihre Arbeit darf keine als Verschlusssache eingestuften oder exportkontrollierten Informationen betreffen, auch nichts, was einem NDA oder einer Prüfung vor der Veröffentlichung unterliegt. Falls Sie solche Verpflichtungen haben, geben Sie dies in Ihrer Bewerbung an, damit die Arbeit entsprechend zugeschnitten werden kann
Vergütung und Rahmenbedingungen
- Vergütung: $65-$75 pro Aufgabe (aufgabenbasiert, nicht stundenbasiert)
- Angegebene Erwartung: etwa 40 Stunden pro Woche
- Remote, keine Standortbeschränkung angegeben
Ähnliche Rollen
Prüfer für Brandschutz und Personensicherheit — Vulcan (m/w/d)
Mercor stellt in den USA ansässige Prüfer für Brandschutzpläne ein, die Aufgaben zur Vorschriftenprüfung für die KI-Bewertung verfassen und kontrollieren. Remote (USA), $45-$60/Std., etwa 40 Stunden pro Woche.
Experte für energetische Materialien für Red Teaming (m/w/d)
Mercor stellt ein Panel aus Experten für Sprengstoffe und energetische Materialien zusammen, die Spitzen-KI-Modelle per Red Teaming testen, indem sie Prompts schreiben und bewerten. Remote, $65-$75 pro Aufgabe.
KI-Sicherheits-Red-Teamer (m/w/d)
Identifizieren Sie Schwachstellen in hochmodernen KI-Systemen durch adversariales Testen – als selbstständiger Auftragnehmer mit wöchentlicher Auszahlung.
