Soy Analista de Datos y egresado de Ingeniería de Sistemas en la UNMSM, con experiencia real construyendo pipelines, dashboards y automatizaciones en producción en Claro Perú.
Me apasiona el punto donde los datos dejan de ser ruido y se convierten en decisiones. Para eso construyo sistemas limpios, escalables y documentados — no solo scripts que funcionan hoy, sino arquitecturas que sobreviven al tiempo y al equipo.
Actualmente profundizando en Data Engineering: orquestación con Airflow, automatización de pipelines y procesamiento de datos con Python y SQL.
Fuera de los datos me encuentras enseñando programación a principiantes, experimentando con automatizaciones en n8n, y buscando el próximo problema que valga la pena resolver.
Actualidad
- Desarrollé 3 dashboards en Power BI con visibilidad diaria sobre 20+ métricas críticas para 10 usuarios de 4 áreas — contribuyendo a una mejora del 4% en los indicadores monitoreados.
- Escalé la arquitectura de reportes para integrar 3 nuevos canales de venta, logrando un aumento del 15% de eficiencia por detección de malas prácticas.
- Implementé flujos en Power Automate que redujeron tiempos operativos de horas a minutos, eliminando intervención manual en reportería.
- Automaticé generación de bases y carga en plataformas con Selenium, liberando 15 horas semanales para análisis de mayor impacto.
- Desarrollé Kit, un sistema de orquestación en Python para procesos ETL, con mecanismo de bloqueo por archivo para evitar doble ejecución, módulo de reintentos configurable y manejo de dependencias entre procesos.
- Refactoricé queries heredadas post-migración, mejorando legibilidad y facilitando el mantenimiento por otros equipos.
Aplicación web de deep learning para predicción de Alzheimer a partir de datos clínicos. Incluye preprocesamiento, modelo de clasificación con ResNet50 y visualización de resultados. Desplegado en producción con Vercel.
PIPELINE
Pipeline ETL sobre datos abiertos de licencias de conducir entregadas por el Callao, con arquitectura por capas (Bronze → Silver → Gold). Incluye extracción, perfilado y transformación de datos con pandas y DuckDB, aplicando buenas prácticas de ingeniería de datos rumbo a un dashboard de tendencias por tiempo, geografía, categoría y trámite.
Flujo de automatización local en n8n que recibía mensajes de Telegram vía webhook (tunelizado con ngrok), los procesaba con Google Gemini como modelo de lenguaje, y respondía consultas o registraba información a través de una API. Memoria persistente en PostgreSQL y dos sub-agentes: consultas y ventas. Pausado por límite de tokens de Gemini.
CENSURADO
Dashboard de métricas comerciales con Power BI, modelado DAX y conexión a base de datos Oracle.
CENSURADO
Dashboard de rendimiento operativo en Power BI, con modelado DAX para el análisis de marcaciones, contactos y tiempos de gestión de asesores conectados.
CENSURADO
Dashboard de rendimiento operativo en Power BI, con modelado DAX para el análisis de resultados de encuestas de satisfacción.