Ingeniero de Datos
Sobre el Puesto
Puesto: Ingeniero de Datos Tipo de Empleo: Full-time Ubicación: Remoto Buscamos un Ingeniero de Datos para construir y escalar la infraestructura de datos que impulsa productos e iniciativas de investigación basados en IA. En este puesto, desarrollará pipelines de datos distribuidos, gestionará conjuntos de datos a gran escala en entornos en la nube, y diseñará sistemas de datos fiables que respalden el procesamiento de datos, la experimentación y el desarrollo de modelos a gran escala.
Qué Harás
- Diseñar, construir y mantener pipelines de datos escalables para ingerir, procesar y transformar conjuntos de datos a gran escala provenientes de múltiples fuentes.
- Desarrollar y optimizar flujos de procesamiento de datos distribuidos utilizando Spark y tecnologías nativas de la nube.
- Construir y mantener soluciones de almacenamiento de datos en sistemas SQL y NoSQL, garantizando escalabilidad, rendimiento y fiabilidad.
- Diseñar e implementar arquitecturas de datos en AWS para soportar la ingesta, el procesamiento y la distribución de datos de gran volumen.
- Escribir código Python y SQL eficiente para extraer, transformar, validar y analizar grandes conjuntos de datos.
- Garantizar la calidad, integridad, monitorización y fiabilidad operativa de los datos en pipelines y capas de almacenamiento.
- Colaborar con investigadores de IA, científicos de datos y equipos de ingeniería para respaldar aplicaciones y experimentación intensivas en datos.
- Implementar automatización, orquestación y flujos de monitorización para respaldar operaciones de datos escalables y eficientes.
Habilidades y Cualificaciones Requeridas
- Sólido dominio de Python, SQL y frameworks de procesamiento de datos distribuido como Apache Spark.
- Experiencia práctica con servicios de datos de AWS y arquitecturas de datos nativas de la nube.
- Experiencia trabajando con bases de datos SQL y NoSQL.
- Experiencia gestionando y procesando conjuntos de datos a gran escala en entornos distribuidos.
- Sólida comprensión del particionamiento de datos, la optimización del rendimiento y las arquitecturas de datos escalables.
Requisitos
- Experiencia con flujos de trabajo de IA/ML o entornos de investigación.
- Experiencia con herramientas de visualización de datos como Matplotlib, Seaborn o Plotly.
- Familiaridad con flujos de datos relacionados con LLM (conjuntos de datos para entrenamiento, evaluación o experimentación con prompts).
Compensación y Logística
El rango salarial nacional para este puesto a tiempo completo es un salario base de $100.000–$150.000 USD. Todos los empleados son elegibles para compensación en acciones, y también pueden recibir bonificaciones basadas en el desempeño, según el puesto y sujeto a las políticas de la empresa. micro1 ofrece un paquete de beneficios integral, que incluye reembolso de hasta el 100% de las primas del seguro médico, tiempo libre remunerado, un plan 401(K) con aportación de la empresa, y beneficios adicionales diseñados para apoyar a una fuerza laboral remota de alto rendimiento.
Aviso Legal
Consulte las columnas Pay Min/Max para el rango de la tarifa por hora.
Empleos relacionados
Programador CAM
Programador CAM — trabajo remoto y remunerado de entrenamiento/evaluación de IA (other) ($80-$120/hora).
Ingeniero Senior de Confiabilidad de Bases de Datos
Ingeniero Senior de Confiabilidad de Bases de Datos — puesto remoto, a tiempo completo y asalariado ($220.000-$260.000/año).
Analista de Sistemas Informáticos
Analista de Sistemas Informáticos — trabajo remoto y remunerado de entrenamiento/evaluación de IA (data-analysis) ($60-$120/hora).
