KI-Sicherheits-Red-Teamer (m/w/d)
Über die Rolle
Wir suchen erfahrene KI-Sicherheits-Red-Teamer, die durch adversariales Testen Schwachstellen in hochmodernen KI-Systemen aufspüren. Sie entwerfen anspruchsvolle Prompts, decken Schwächen von Modellen auf und bewerten das Verhalten von KI bei komplexen, risikoreichen und mehrdeutigen („Grauzonen“-)Themen.
Ihre Aufgaben
- Adversariale Prompts entwerfen, um hochmoderne KI-Modelle auf die Probe zu stellen
- Jailbreaks, unsicheres Verhalten, Halluzinationen und Richtlinienverstöße identifizieren
- Die Robustheit von Modellen in Bereichen wie Desinformation, Cybersicherheit, Biosicherheit, Betrug, politische Inhalte und weiteren sensiblen Themen bewerten
- Schwachstellen dokumentieren und zu Sicherheits-Benchmarks und Red-Teaming-Berichten beitragen
- Mit KI-Forschern zusammenarbeiten, um Alignment, Robustheit und Sicherheit der Modelle zu verbessern
Anforderungen
- Bachelor-Abschluss oder höher in Informatik, Cybersicherheit, Journalismus, Kommunikationswissenschaft, Psychologie, Biologie, Chemie, Public Policy oder einer verwandten Disziplin
- Mindestens 5 Jahre Berufserfahrung in KI-Sicherheit, KI-Red-Teaming, Trust & Safety, Cybersicherheit, investigativem Journalismus, Lebenswissenschaften oder einem verwandten Bereich
- Starke analytische Denkfähigkeit, Prompt-Design und schriftliche Kommunikationsfähigkeit
- Erfahrung im Entwerfen adversarialer Prompts oder in der Bewertung hochmoderner KI-Systeme
Wünschenswerte Qualifikationen
- Erfahrung mit KI-Red-Teaming, RLHF, SFT, KI-Alignment oder Trust & Safety
- Vertrautheit mit Jailbreak-Tests, Prompt Engineering oder adversarialen Bewertungsmethoden
- Expertise in einem oder mehreren Grauzonen-Bereichen, darunter Cybersicherheit, Biosicherheit, politische Inhalte, Desinformation oder wissenschaftliche Sicherheit
Warum mitmachen
- Helfen Sie mit, die nächste Generation hochmoderner KI-Modelle abzusichern und zu stärken
- Arbeiten Sie an modernstem adversarialem Testen an der Seite führender KI-Forscher und Sicherheitsteams
- Nehmen Sie Einfluss darauf, wie KI-Systeme auf komplexe, reale Sicherheitsherausforderungen reagieren
Vergütung und Rahmenbedingungen
- Art: selbstständiger Auftragnehmer
- Vergütung: wettbewerbsfähig, wöchentliche Auszahlung über Stripe oder Wise
- Standort: Remote
- Bewerbung: Reichen Sie Ihren Lebenslauf oder Ihren einschlägigen beruflichen Hintergrund ein. Qualifizierte Bewerber werden gegebenenfalls gebeten, einen kurzen Test zu absolvieren oder weitere Informationen einzureichen. Bewerbungen werden fortlaufend geprüft.
Ähnliche Rollen
Prüfer für Brandschutz und Personensicherheit — Vulcan (m/w/d)
Mercor stellt in den USA ansässige Prüfer für Brandschutzpläne ein, die Aufgaben zur Vorschriftenprüfung für die KI-Bewertung verfassen und kontrollieren. Remote (USA), $45-$60/Std., etwa 40 Stunden pro Woche.
Chemikaliensicherheit für Red Teaming (m/w/d)
Mercor stellt Chemie-Experten ein, die Spitzen-KI-Modelle per Red Teaming testen, indem sie harmlose, Dual-Use- und adversariale Prompts schreiben und beurteilen. Remote, $65-$75 pro Aufgabe.
Experte für energetische Materialien für Red Teaming (m/w/d)
Mercor stellt ein Panel aus Experten für Sprengstoffe und energetische Materialien zusammen, die Spitzen-KI-Modelle per Red Teaming testen, indem sie Prompts schreiben und bewerten. Remote, $65-$75 pro Aufgabe.
