Experte für Verhaltensgesundheit, KI-Sicherheit und Modellbewertung (m/w/d)
Über die Rolle
Ein führendes KI-Labor benötigt Experten für Verhaltensgesundheit, um zu bewerten, wie seine Modelle mit sensiblen, aber nicht krisenhaften Gesprächen über Beziehungen, Familie, emotionales Wohlbefinden und persönliche Überzeugungen umgehen. Sie beurteilen, ob Antworten ausgewogen bleiben, Anbiederung vermeiden und die Grenzen der Rolle des Modells respektieren. Die Stelle ist ein W-2-Beschäftigungsverhältnis bei Cincinnatus LLC, mit Einsatz beim Labor als erweiterte Belegschaft.
Ihre Aufgaben
- Gespräche zwischen Nutzern und Modell bewerten und beurteilen, ob die Antworten neutral, angemessen und sicher sind.
- Bedenken wie übermäßige Zustimmung, Parteinahme, Bestärkung unbegründeter Überzeugungen, Moralisieren oder Übergriffe in klinische Ratschläge mit schriftlicher Begründung kennzeichnen.
- Bewertungsraster, Richtlinien und Referenzantworten auf Grundlage der Beratungspraxis entwickeln.
- Testszenarien entwerfen, die sensible, nicht krisenhafte Themen ausloten.
- Sich mit Forschenden und anderen Experten abstimmen.
Anforderungen
- Abschluss in Psychologie, Beratung, Sozialarbeit, Verhaltensgesundheit oder einem verwandten Fach oder gleichwertige Berufserfahrung im Bereich psychische Gesundheit.
- Über 3 Jahre Unterstützung von Menschen in der psychischen Gesundheit, Beratung oder in sozialen Diensten; eine Zulassung ist von Vorteil, aber nicht erforderlich.
- Neutrales, wertfreies Urteilen gegenüber unterschiedlichen Überzeugungen und Weltanschauungen.
- Vertrautheit mit Anbiederung, kognitiven Verzerrungen, Grenzen und motivierender Gesprächsführung.
- Mindestens 20 Stunden pro Woche an Werktagen; überzeugendes schriftliches Feedback.
Vergütung und Rahmenbedingungen
$45-$70 pro Stunde, mindestens 20 Stunden pro Woche mit der Option auf 40. Remote innerhalb der Vereinigten Staaten. W-2-Beschäftigung über Cincinnatus LLC.
Ähnliche Rollen
Prüfer für Brandschutz und Personensicherheit — Vulcan (m/w/d)
Mercor stellt in den USA ansässige Prüfer für Brandschutzpläne ein, die Aufgaben zur Vorschriftenprüfung für die KI-Bewertung verfassen und kontrollieren. Remote (USA), $45-$60/Std., etwa 40 Stunden pro Woche.
Chemikaliensicherheit für Red Teaming (m/w/d)
Mercor stellt Chemie-Experten ein, die Spitzen-KI-Modelle per Red Teaming testen, indem sie harmlose, Dual-Use- und adversariale Prompts schreiben und beurteilen. Remote, $65-$75 pro Aufgabe.
Experte für energetische Materialien für Red Teaming (m/w/d)
Mercor stellt ein Panel aus Experten für Sprengstoffe und energetische Materialien zusammen, die Spitzen-KI-Modelle per Red Teaming testen, indem sie Prompts schreiben und bewerten. Remote, $65-$75 pro Aufgabe.
