← Zurück zu allen Jobs

KI-Sicherheits-Red-Teamer (m/w/d)

Standort: RemoteZulässige Standorte: WeltweitVertragsart: VertragVergütung: $70 – $84Veröffentlicht: 28. Juli 2026

Über die Rolle

Wir suchen erfahrene KI-Sicherheits-Red-Teamer, die durch adversariales Testen Schwachstellen in hochmodernen KI-Systemen aufspüren. Sie entwerfen anspruchsvolle Prompts, decken Schwächen von Modellen auf und bewerten das Verhalten von KI bei komplexen, risikoreichen und mehrdeutigen („Grauzonen“-)Themen.

Ihre Aufgaben

  • Adversariale Prompts entwerfen, um hochmoderne KI-Modelle auf die Probe zu stellen
  • Jailbreaks, unsicheres Verhalten, Halluzinationen und Richtlinienverstöße identifizieren
  • Die Robustheit von Modellen in Bereichen wie Desinformation, Cybersicherheit, Biosicherheit, Betrug, politische Inhalte und weiteren sensiblen Themen bewerten
  • Schwachstellen dokumentieren und zu Sicherheits-Benchmarks und Red-Teaming-Berichten beitragen
  • Mit KI-Forschern zusammenarbeiten, um Alignment, Robustheit und Sicherheit der Modelle zu verbessern

Anforderungen

  • Bachelor-Abschluss oder höher in Informatik, Cybersicherheit, Journalismus, Kommunikationswissenschaft, Psychologie, Biologie, Chemie, Public Policy oder einer verwandten Disziplin
  • Mindestens 5 Jahre Berufserfahrung in KI-Sicherheit, KI-Red-Teaming, Trust & Safety, Cybersicherheit, investigativem Journalismus, Lebenswissenschaften oder einem verwandten Bereich
  • Starke analytische Denkfähigkeit, Prompt-Design und schriftliche Kommunikationsfähigkeit
  • Erfahrung im Entwerfen adversarialer Prompts oder in der Bewertung hochmoderner KI-Systeme

Wünschenswerte Qualifikationen

  • Erfahrung mit KI-Red-Teaming, RLHF, SFT, KI-Alignment oder Trust & Safety
  • Vertrautheit mit Jailbreak-Tests, Prompt Engineering oder adversarialen Bewertungsmethoden
  • Expertise in einem oder mehreren Grauzonen-Bereichen, darunter Cybersicherheit, Biosicherheit, politische Inhalte, Desinformation oder wissenschaftliche Sicherheit

Warum mitmachen

  • Helfen Sie mit, die nächste Generation hochmoderner KI-Modelle abzusichern und zu stärken
  • Arbeiten Sie an modernstem adversarialem Testen an der Seite führender KI-Forscher und Sicherheitsteams
  • Nehmen Sie Einfluss darauf, wie KI-Systeme auf komplexe, reale Sicherheitsherausforderungen reagieren

Vergütung und Rahmenbedingungen

  • Art: selbstständiger Auftragnehmer
  • Vergütung: wettbewerbsfähig, wöchentliche Auszahlung über Stripe oder Wise
  • Standort: Remote
  • Bewerbung: Reichen Sie Ihren Lebenslauf oder Ihren einschlägigen beruflichen Hintergrund ein. Qualifizierte Bewerber werden gegebenenfalls gebeten, einen kurzen Test zu absolvieren oder weitere Informationen einzureichen. Bewerbungen werden fortlaufend geprüft.