Data Governance Senior buscando nuevas oportunidades
Experiencia demostrada en Python.
Experiencia demostrada en PySpark.
Experiencia demostrada en Apache Spark.
Experiencia demostrada en SQL.
Experiencia demostrada en Oracle.
Scanntech
Lidero un equipo de 10 ingenieros de datos distribuido en múltiples líneas de producto, coordinando roadmap técnico, delivery, prioridades y desarrollo del talento del equipo para impactar a nuestros clientes de Brasil, Uruguay, Chile, Colombia, Peru, Argentina y Mexico.. Diseño e implemento pipelines de datos que procesan más de 50 fuentes de información para clientes top, reduciendo el tiempo de procesamiento en 33% mediante paralelización, tablas delta, Python y Spark.. Estandaricé el flujo de integración de fuentes de datos usando GitHub como control de versiones, reduciendo incidencias de calidad en 18%.. Implementé prácticas ágiles y mejora continua en el equipo, incrementando la velocidad de entrega y reduciendo el lead time.. Impulsé la adopción de herramientas de IA (Cursor, Claude Code) en el equipo de ingeniería, reduciendo el tiempo de desarrollo y revisión de código en 22%.. Preparé la migración de nuestros orígenes de datos del Data Lake corporativo hacia arquitectura Medallion.
TATA (Cliente: Rimac Seguros)
Definí la estrategia y el plan de datos del proyecto (construcción, remediación y captura), reduciendo inconsistencias en datos críticos de pricing en 15%.. Establecí trazabilidad, reglas de calidad y umbrales de cumplimiento como parte del marco de Gobierno de Datos adoptado por el proyecto.. Trabajé con herramientas de la suite de Google Cloud Platform: BigQuery como repositorio de datos, Dataflow para transformación, y Data Catalog / Dataplex para calidad y gobierno de datos.. Identifiqué y formalicé la captura de datos críticos ausentes en sistemas estructurados, creando los procesos asociados junto a áreas de negocio.. Presenté avances semanales a stakeholders senior (Actuarial, TI, Pricing) y gerencia, sosteniendo el cronograma del proyecto sin desviaciones críticas.
Indra
Migré y optimicé lógicas de negocio desarrollado por el equipo de Data Science de un entorno on-premise a Data Lake productivo, utilizando Python, Spark y Oracle.. Configuré el ambiente HDFS y habilité accesos de Data Warehouse mediante pipelines de datos.. Automaticé el pase a producción vía Jenkins con trazabilidad en Jira, reduciendo el tiempo de release de 3 días a 4 horas.
Prima AFP
Desarrollé e implementé el modelo de priorización de cartera de cobranzas (CRISP-DM), aumentando la tasa de recuperación en 14%.. Lideré la migración de la base de datos de Fuerza de Ventas de SQL Server a Oracle Cloud (OCC), reduciendo tiempos de procesamiento para reportería en 38%.. Estructuré la data del proyecto "Leads de cartera de traspasos FFVV", optimizando los tiempos de gestión comercial del equipo de ventas.
Prima AFP
Lideré el proyecto de actualización de datos de contacto, incrementando en 13% el indicador de clientes con datos de contacto válidos — impacto directo en la capacidad de cobranza y contacto comercial.. Desarrollé ETLs para integrar múltiples fuentes de información y automatizar rutinas de negocio usando Pentaho y Python.. Desplegué y di seguimiento a dashboards de calidad de datos; participé como desarrollador DataStage en el proyecto Data Lake (pruebas unitarias/integrales, mallas de Jobs, pases a producción).
Prima AFP
Mapeé y estructuré 14 dominios de datos críticos (TI y no TI) para implementar la metodología de Gobierno de Datos de la organización.. Elaboré reglas de calidad técnica y de negocio, y desarrollé el script de medición de calidad de datos.
Bachiller, Ingeniería de Sistemas
Especialización, Data Science