KI-Sicherheitsspezialist (m/w/d)
Über die Rolle
Wir suchen erfahrene KI-Sicherheitsspezialisten, die Sicherheit, Qualität und Alignment hochmoderner KI-Modelle bei komplexen, richtlinienrelevanten und mehrdeutigen („Grauzonen“-)Themen bewerten. Sie beurteilen KI-generierte Antworten, wenden Sicherheitsrichtlinien an und helfen, das Modellverhalten durch strukturierte Bewertungen und Feedback zu verbessern.
Ihre Aufgaben
- KI-generierte Antworten auf Sicherheit, sachliche Richtigkeit, Richtlinienkonformität und Gesamtqualität bewerten
- Inhalte zu Desinformation, politischer Beeinflussung, Selbstverletzung, Gewalt, Cybersicherheit, Biosicherheit und weiteren sensiblen Themen prüfen
- Bewertungsraster für RLHF, SFT und KI-Sicherheits-Benchmarks anwenden und weiterentwickeln
- Unsichere Ausgaben, Halluzinationen, Denkfehler und Richtlinienverstöße identifizieren
- Strukturiertes Feedback geben, um Alignment und Sicherheit der Modelle zu verbessern
- Mit KI-Forschern und Sicherheitsteams an laufenden Bewertungsinitiativen zusammenarbeiten
Anforderungen
- Bachelor-Abschluss oder höher in Journalismus, Kommunikationswissenschaft, Psychologie, Soziologie, Public Policy, Rechtswissenschaft, Biologie, Chemie, Informatik oder einer verwandten Disziplin
- Mindestens 5 Jahre Berufserfahrung in KI-Sicherheit, Trust & Safety, Journalismus, Public Policy, wissenschaftlicher Forschung, Sicherheit oder einem verwandten Bereich
- Ausgezeichnetes schriftliches Englisch, kritisches Denken und analytische Denkfähigkeit
- Fähigkeit, nuancierte und richtlinienrelevante Szenarien konsistent zu bewerten
Wünschenswerte Qualifikationen
- Erfahrung mit KI-Sicherheit, RLHF, SFT, Trust & Safety oder KI-Bewertung
- Vertrautheit mit Sicherheitsrichtlinien, Content-Moderation oder der Entwicklung von Bewertungsrastern
- Erfahrung in der Prüfung komplexer, risikoreicher oder mehrdeutiger Inhalte
Warum mitmachen
- Gestalten Sie Sicherheit und Verhalten hochmoderner KI-Modelle mit, die weltweit von Millionen Menschen genutzt werden
- Arbeiten Sie an anspruchsvollen, realen Sicherheitsbewertungen in nuancierten und folgenreichen Bereichen
- Arbeiten Sie mit führenden KI-Forschern, Ingenieuren und Sicherheitsteams zusammen
Vergütung und Rahmenbedingungen
- Art: selbstständiger Auftragnehmer
- Vergütung: wettbewerbsfähig, wöchentliche Auszahlung über Stripe oder Wise
- Standort: Remote
- Bewerbung: Reichen Sie Ihren Lebenslauf oder Ihren einschlägigen beruflichen Hintergrund ein. Qualifizierte Bewerber werden gegebenenfalls gebeten, einen kurzen Test zu absolvieren oder weitere Informationen einzureichen. Bewerbungen werden fortlaufend geprüft.
Ähnliche Rollen
KI-Sicherheits-Red-Teamer (m/w/d)
Identifizieren Sie Schwachstellen in hochmodernen KI-Systemen durch adversariales Testen – als selbstständiger Auftragnehmer mit wöchentlicher Auszahlung.
Break-It-To-Build-It — Hardware-Tester (m/w/d)
Break-It-To-Build-It — Hardware-Tester — remote, bezahlte Arbeit im KI-Training und in der KI-Bewertung (Robotik) ($10-$20/Std.).
UX/UI-Designer-Experte (m/w/d)
Entwickeln Sie Bewertungskriterien und bewerten Sie KI-generierte digitale Produkt- und UX-Arbeiten – Designsysteme, Abläufe, Dashboards – $80–$150/Std., vollständig remote.
