Engenheiro de Dados
Sobre a Função
Cargo: Engenheiro de Dados Tipo de Contrato: Full-time Localização: Remoto Procuramos um Engenheiro de Dados para construir e escalar a infraestrutura de dados que sustenta produtos e iniciativas de investigação baseados em IA. Nesta função, irá desenvolver pipelines de dados distribuídos, gerir conjuntos de dados de grande escala em ambientes cloud, e conceber sistemas de dados fiáveis que apoiem o processamento de dados, a experimentação e o desenvolvimento de modelos a grande escala.
O Que Vai Fazer
- Conceber, construir e manter pipelines de dados escaláveis para ingerir, processar e transformar conjuntos de dados de grande escala provenientes de múltiplas fontes.
- Desenvolver e otimizar fluxos de processamento de dados distribuídos utilizando Spark e tecnologias cloud-native.
- Construir e manter soluções de armazenamento de dados em sistemas SQL e NoSQL, garantindo escalabilidade, desempenho e fiabilidade.
- Conceber e implementar arquiteturas de dados na AWS para suportar ingestão, processamento e distribuição de dados de elevado volume.
- Escrever código Python e SQL eficiente para extrair, transformar, validar e analisar grandes conjuntos de dados.
- Garantir a qualidade, integridade, monitorização e fiabilidade operacional dos dados em pipelines e camadas de armazenamento.
- Colaborar com investigadores de IA, cientistas de dados e equipas de engenharia para apoiar aplicações e experimentação intensivas em dados.
- Implementar automação, orquestração e fluxos de monitorização para suportar operações de dados escaláveis e eficientes.
Competências e Qualificações Necessárias
- Forte domínio de Python, SQL e frameworks de processamento de dados distribuído como o Apache Spark.
- Experiência prática com serviços de dados AWS e arquiteturas de dados cloud-native.
- Experiência a trabalhar com bases de dados SQL e NoSQL.
- Experiência a gerir e processar conjuntos de dados de grande escala em ambientes distribuídos.
- Forte compreensão de particionamento de dados, otimização de desempenho e arquiteturas de dados escaláveis
Requisitos
- Contacto com fluxos de trabalho de IA/ML ou ambientes de investigação.
- Experiência com ferramentas de visualização de dados como Matplotlib, Seaborn ou Plotly.
- Familiaridade com fluxos de dados relacionados com LLM (conjuntos de dados para treino, avaliação ou experimentação de prompts).
Remuneração e Logística
O intervalo salarial nacional para esta posição a tempo inteiro é um salário base de $100.000–$150.000 USD. Todos os colaboradores são elegíveis para compensação em equity, podendo também receber bónus baseados em desempenho, dependendo da função e sujeitos às políticas da empresa. A micro1 disponibiliza um pacote de benefícios abrangente, incluindo reembolso até 100% dos prémios de seguro de saúde, férias remuneradas, um plano 401(K) com contrapartida da empresa, e benefícios adicionais concebidos para apoiar uma força de trabalho remota de alto desempenho.
Aviso
Consulte as colunas Pay Min/Max para o intervalo da taxa horária.
Vagas relacionadas
Programador(a) CAM
Programador(a) CAM — trabalho remoto e remunerado de treino/avaliação de IA (other) ($80-$120/hora).
Engenheiro(a) Sénior de Fiabilidade de Bases de Dados
Engenheiro(a) Sénior de Fiabilidade de Bases de Dados — função remota, a tempo inteiro e assalariada ($220.000-$260.000/ano).
Analista de Sistemas Informáticos
Analista de Sistemas Informáticos — trabalho remoto e remunerado de treino/avaliação de IA (data-analysis) ($60-$120/hora).
