Especialista em Saúde Comportamental, Segurança de IA e Avaliação de Modelos
Sobre a Função
Um laboratório de IA de topo precisa de especialistas em saúde comportamental para avaliar como os seus modelos lidam com conversas sensíveis, mas sem situação de crise, sobre relações, família, bem-estar emocional e crenças pessoais. Vais avaliar se as respostas se mantêm equilibradas, evitam a bajulação e respeitam os limites do papel do modelo. A posição é W-2 com a Cincinnatus LLC, colocada no laboratório como força de trabalho alargada.
O Que Vais Fazer
- Avaliar conversas entre utilizadores e o modelo e determinar se as respostas são neutras, adequadas e seguras.
- Assinalar preocupações como concordância excessiva, tomar partido, reforçar crenças infundadas, moralizar ou ultrapassar os limites para aconselhamento clínico, com justificação escrita.
- Desenvolver grelhas de avaliação, diretrizes e respostas de referência baseadas na prática de aconselhamento.
- Conceber cenários de teste que explorem temas sensíveis sem situação de crise.
- Calibrar critérios com investigadores e outros especialistas.
Requisitos
- Licenciatura em psicologia, aconselhamento, serviço social, saúde comportamental ou área afim, ou experiência profissional equivalente em saúde mental.
- 3+ anos a apoiar pessoas em contextos de saúde mental, aconselhamento ou serviços sociais; a licença profissional é valorizada, mas não obrigatória.
- Raciocínio neutro e sem julgamentos perante diversas crenças e visões do mundo.
- Familiaridade com bajulação, distorções cognitivas, limites e entrevista motivacional.
- Pelo menos 20 horas por semana em dias úteis; bom feedback escrito.
Compensação e Logística
$45-$70 por hora, pelo menos 20 horas por semana, com a opção de aumentar para 40. Remoto dentro dos Estados Unidos. Emprego W-2 através da Cincinnatus LLC.
Vagas relacionadas
Revisor de Segurança contra Incêndios e Proteção de Vidas — Vulcan
A Mercor está a contratar revisores de projetos de segurança contra incêndios sediados nos EUA para criar e verificar tarefas de revisão de códigos para avaliação de IA. Remoto (EUA), $45-$60/h, cerca de 40 horas por semana.
Segurança Química para Red Teaming
A Mercor está a contratar especialistas em química para fazer red teaming a modelos de IA de ponta, escrevendo e avaliando prompts benignos, de dupla utilização e adversariais. Remoto, $65-$75 por tarefa.
Especialista em Materiais Energéticos para Red Teaming
A Mercor está a reunir especialistas em explosivos e materiais energéticos para fazer red teaming a modelos de IA de ponta, escrevendo e avaliando prompts. Remoto, $65-$75 por tarefa.
