Descripción del trabajo
Trabajarás en colaboración con científicos de datos, ingenieros de Machine Learning y equipos de negocio para construir soluciones escalables, garantizar la calidad de los datos y facilitar su disponibilidad para entornos de producción.
Responsabilidades:
- Diseñar, desarrollar y mantener pipelines de datos escalables para proyectos de analítica e inteligencia artificial.
- Colaborar con científicos de datos, ingenieros de Machine Learning y otros equipos para garantizar el acceso a datos fiables, consistentes y preparados para producción.
- Desarrollar y mantener API para el acceso, integración y gestión de datos.
- Diseñar y optimizar soluciones de almacenamiento para datos estructurados y no estructurados, incluyendo bases de datos relacionales, NoSQL, motores de búsqueda y almacenamiento de objetos.
- Gestionar datos de diferentes formatos, como texto, imágenes, audio y vídeo, para dar soporte a modelos de aprendizaje automático.
- Implementar procesos de monitorización y control de la calidad de los datos.
- Proporcionar soporte técnico y asesoramiento en arquitectura de datos a los equipos de Machine Learning.
- Participar en la gestión de metadatos utilizando herramientas especializadas.
- Garantizar el cumplimiento de las políticas de seguridad y privacidad de la información.
- Mantener actualizada la documentación técnica, incluyendo diccionarios de datos, metadatos y diagramas de arquitectura.
- Colaborar en el desarrollo de soluciones de procesamiento de datos en tiempo real y sistemas de streaming.
Requisitos:
- Titulación universitaria en Informática, Ingeniería, Matemáticas o una disciplina relacionada, o experiencia profesional equivalente.
- Más de 8 años de experiencia en ingeniería de datos.
- Dominio de Python, Java y Scala.
- Experiencia gestionando grandes volúmenes de datos, desde terabytes hasta petabytes.
- Experiencia con tecnologías Big Data, como Hadoop, Apache Spark y Apache Flink.
- Conocimientos de frameworks de aprendizaje automático como TensorFlow, PyTorch o similares.
- Conocimientos de almacenamiento de datos, procesos ETL y modelado de datos.
- Experiencia desarrollando API REST y/o GraphQL.
- Conocimientos de prácticas DevOps, integración y despliegue continuo (CI/CD) y contenerización con Docker o Kubernetes.
- Experiencia con plataformas de streaming como Kafka o RabbitMQ.
Salario a percibir
A convenir
Regístrate o identifícate
- Debes estar registrado para solicitar una oferta.
- El tener un perfil completo en Remotojob.com garantiza que tu currículum tendrá mayor exposición.
- Estar registrado nos ayuda a prevenir el spam y los convocantes fantasma.
- Las empresas otorgan mayor credibilidad a los perfiles con descripciones e imágenes completas.
Para ver el contacto directo del empleo, debes tener una cuenta regístrate ahora.



