Data Engineer

Diego PardoMontero

Construyo y opero plataformas de datos en producción: bases de datos y pipelines que mueven la información de forma confiable, modelos que la hacen usable y el monitoreo que mantiene todo corriendo. Ingeniero de Sistemas con base sólida en backend y cloud.

Data Engineer con 3+ años construyendo y operando plataformas de datos en producción: bases de datos que aguantan, pipelines que corren todos los días, datos que llegan completos y a tiempo y sistemas que siguen funcionando cuando algo falla.

Qué hago

Diseño bases de datos relacionales y analíticas (Oracle, PostgreSQL, MySQL, Snowflake); construyo pipelines ETL/ELT en Python, SQL y PySpark; modelo los datos para que respondan las preguntas que un equipo realmente hace; los opero en producción con monitoreo, análisis de causa raíz y correcciones permanentes.

Trayectoria

Ingeniero de Sistemas de la Pontificia Universidad Javeriana (promedio 4.4/5.0, tesis con honores). Dos años diseñando esquemas y servicios backend en Java y Spring antes de especializarme en datos, así que hablo ambos lados del stack.

Busco

Roles de Data Engineer, Analytics Engineer o Data Platform, híbridos en Bogotá o totalmente remotos, en equipos donde los datos tienen que ser confiables a escala.

Abr 2026 – Presente
Bogotá · híbrido

Data Engineer · Diametral

  • Diseño y construcción de un framework en Python dirigido por configuración para migraciones Oracle a gran escala: definiciones declarativas en YAML y SQL, múltiples estrategias de carga (catálogo, SCD Tipo 2, hechos, agregados), auditoría y control de concurrencia
  • Scheduler dirigido por tabla de control y módulo de reportería para observabilidad de pipelines, orquestando ciclos batch diarios y semanales sobre arquitectura Medallion (Bronze/Silver/Gold) con PySpark y Starburst (Trino)
  • Monitoreo de pipelines en producción y resolución de incidentes de punta a punta en servicios financieros: análisis de causa raíz, correcciones permanentes y documentación, en coordinación con los equipos de DBA y DevOps

Python · SQL · PySpark · Oracle · Starburst/Trino · Airflow · GCP · Databricks · IBM Cloud

Ago 2025 – Abr 2026
Bogotá · híbrido

Data Engineer Jr. Advanced · Globant

  • Optimización de pipelines ETL a gran escala y flujos de backend en Python y SQL, con reducción de ~20% en tiempos de ejecución mediante ajuste de consultas y automatización
  • Validaciones y controles de calidad automatizados que redujeron la verificación manual en 65% y mejoraron la confiabilidad de los datos en producción
  • Resolución de ~7 incidentes de datos en producción al día dentro de SLA, con análisis de causa raíz y correcciones entre equipos

Python · SQL · Java · Spring · AWS · Docker · Angular · TypeScript · Linux · Bash

Ene 2025 – Jul 2025
Bogotá

Information Technology Trainee · Globant

  • Mantenimiento y depuración de pipelines ETL en Snowflake y Airflow, con 25% menos fallos de jobs
  • Scripts de validación en Python para detectar discrepancias e inconsistencias en datasets de miles de registros
  • Automatización de procesos recurrentes de backend con Python y Bash, ahorrando ~6–8 horas de trabajo manual por semana

Python · SQL · Snowflake · Airflow · Spark · Java · Docker

Ene 2023 – Dic 2024
Remoto

Data Engineer · Pacífico Emprende

  • Diseño del modelo relacional en MySQL para una plataforma con más de 200 usuarios: entidades, llaves, normalización y restricciones de integridad que mantuvieron los datos consistentes mientras el producto crecía durante dos años
  • Optimización del SQL detrás de las vistas más pesadas, con reducción de ~20% en tiempos de carga
  • Servicios backend de datos construidos desde cero en Java y Spring, de modo que el esquema y el código que lo leía se diseñaron juntos
  • Dos años sobre la misma capa de datos, del primer esquema a las consultas que el producto corría todos los días

MySQL · SQL · Java · Spring Boot · Django · PHP · WordPress

2022 – 2024

Monitor académico, Pontificia Universidad Javeriana: Sistemas Distribuidos, Estructuras de Datos e Introducción a la Programación.

Impacto medido
−20%

en tiempos de ejecución de los pipelines ETL que optimicé

Globant · 2025–2026
−65%

de verificación manual, reemplazada por validaciones automatizadas

Globant · 2025–2026
−25%

de fallos de jobs en los pipelines de Snowflake y Airflow que mantuve

Globant · 2025
6–8 h

de trabajo manual ahorradas por semana automatizando procesos recurrentes

Globant · 2025

Pontificia Universidad Javeriana

Ingeniería de Sistemas · 2021–2025

Promedio 4.4/5.0
Doble énfasis: Desarrollo Avanzado de Software y Sistemas de Gestión de Datos
Tesis con honores 5.0/5.0
8 reconocimientos de excelencia académica
ACM Javeriana (Senior, 2020–2022) · IEEE RAS Javeriana

Idiomas

Español (nativo) · Inglés C1, Professional Working Proficiency

Ruta de certificación
Certificaciones
  • AWS Certified Solutions Architect – AssociateAWS
  • AWS Certified Cloud PractitionerAWS
  • Google Cloud Digital LeaderGoogle
  • Architecting with GKE: FoundationsGoogle
  • Application Development using Microservices and ServerlessIBM
  • Introduction to DatabasesMeta
  • SQL (Intermediate) · JavaHackerRank
  • Gestión de proyectosTecnológico de Monterrey

En cursoDatabricks Data Engineer Associate · Snowflake SnowPro Core

+40 certificaciones adicionales, ver LinkedIn

El camino que recorren los datos por los sistemas que construyo. Las herramientas en tinta plena están en producción sostenida; las más claras, en alcance profesional acotado.

El pipeline

Fuentes

Oracle · Snowflake · PostgreSQL · MySQL

PL/SQL · Azure Data Factory · IBM Cloud

Procesamiento

Python · PySpark · ETL / ELT

Pandas · NumPy · Databricks · Azure Databricks

Modelado

Medallion · SCD Tipo 2 · Dimensional

Starburst / Trino · marts · optimización de consultas

Orquestación

Airflow · Linux · Bash

Docker · CI/CD · Git · GitHub

Calidad y operación

Validación de datos · Incidentes y RCA

Observabilidad · SLA · Agile / Scrum

Alrededor del pipeline

Bases de datos

Oracle · PostgreSQL · MySQL · Snowflake

PL/SQL · modelado relacional · SCD Tipo 2 · optimización de consultas

Backend

Java · Spring Boot · REST APIs

TypeScript · Angular · Django · Node.js

Cloud

AWS · GCP · Azure Databricks · IBM Cloud

Certificado: AWS SAA, AWS CCP, GCP Digital Leader

Forma de trabajar

Git · GitHub · CI/CD · Docker

Agile / Scrum · Postman / Swagger · Linux

Estudiado, aún no en producción

Kubernetes / GKE · Kafka · Microservicios

Serverless · React · Machine Learning · GraphQL · Sistemas distribuidos

Proyecto personal · 2026

Orión, plataforma de agendamiento para una academia de idiomas

Los estudiantes reservan clases según las reglas de disponibilidad de cada profesor. Backend modular en Spring Boot con migraciones versionadas de PostgreSQL, sesiones de servidor y acceso por rol; front en Next.js; y una suite de pruebas de punta a punta, todo sobre Docker.

JavaSpring BootPostgreSQLNext.jsDocker
Tesis con honores · 5.0/5.0 · 2025

Enseñarte

Prototipo funcional para la enseñanza, aprendizaje y evaluación de Lengua de Señas Colombiana (LSC), con el modelo de datos y el pipeline que capturan, almacenan y evalúan el progreso de cada estudiante.

KotlinTensorFlowPythonMachine Learning
Proyecto personal · 2024

Plataforma e-commerce con microservicios

Arquitectura de microservicios con patrón base de datos por servicio, comunicación orientada a eventos entre servicios, contenedores Docker y APIs REST.

JavaSpring BootDockerPostgreSQLKafka

¿Buscas un data engineer para tu equipo? Hablemos.

Abierto a roles de tiempo completo como Data Engineer, Analytics Engineer o Data Platform Engineer, híbridos en Bogotá o totalmente remotos. Correo, llamada o WhatsApp, lo que prefieras.