Saltar al contenido
Disponible para nuevos proyectos

Alonso Marcos Muñoz

Data Engineer · Pipelines, modelado y plataformas

Construyo pipelines, modelos y plataformas de datos con Python y SQL. Aporto experiencia profesional en metadatos públicos y proyectos aplicados con Databricks, Spark, Airflow, Kafka y AWS.

Python · SQL · PostgreSQL · Databricks · Spark · Airflow · Kafka · AWS

Albacete, España
Alonso Marcos Muñoz

5.771

Datasets publicados y federados

22

Organismos de la AGE

13

Servicios comunes de alto valor

4,48/5

Satisfacción · fuente oficial

Perfil

Soy Ingeniero de Datos en Tragsatec, dentro del proyecto ImpulsaDATA para la Dirección General del Dato. Construyo y opero pipelines ETL con Python y SQL que integran, validan y publican la información de los catálogos de datos de 22 ministerios y organismos públicos.

Cubro el ciclo completo: modelar y transformar datos en PostgreSQL y Oracle, automatizar controles de calidad y desplegar en desarrollo, pruebas y producción. Dentro del proyecto AgoraData lidero el desarrollo de la interfaz web que sirve de front-end a todo el backend y a los procesos Python de ImpulsaDATA, con Java, Spring Boot, Vaadin y PostgreSQL.

El Máster en Big Data y Computación en la Nube me ha dado práctica con Databricks, Spark, Kafka, Airflow y AWS, y la certificación CAPM, método para planificar alcance, riesgos y entregas. En el día a día uso flujos de trabajo agénticos con IA para acelerar el desarrollo, las pruebas y la revisión de código sin perder trazabilidad.

Experiencia profesional

Tragsatec

TragsatecActualidad

Oct 2025 – Actualidad

Ingeniero de Datos · ImpulsaDATA

Albacete, España

datos.gob.es

Trabajo en el proyecto ImpulsaDATA / Gestión de la Demanda del Dato Público para la Dirección General del Dato. Mi trabajo se centra en integrar, transformar, validar y publicar la información de los catálogos de datos de 22 ministerios y organismos públicos.

  • Desarrollo y mantengo pipelines ETL en Python y SQL que recogen, limpian, validan y publican de forma automática la información de los catálogos de datos de 22 ministerios y organismos públicos.
  • Diseño transformaciones, agregaciones y vistas en PostgreSQL y Oracle para que la información llegue estructurada, coherente y lista para consultarse y publicarse.
  • Automatizo controles de calidad que comprueban que cada conjunto de datos cumple el estándar europeo de datos abiertos antes de publicarse, para evitar que lleguen errores a los catálogos oficiales.
  • Adapto y extiendo CKAN, la plataforma de datos abiertos del proyecto, con un perfil común DCAT-AP-ES para todos los organismos, recolección automática de catálogos (harvesting) y datos geoespaciales.
  • Administro OpenMetadata, la plataforma de catálogo y gobierno del dato, en el entorno de pruebas, la uso en producción y la conecto por API con la herramienta de conversión de metadatos del proyecto.
  • Preparo y opero los entornos de desarrollo, pruebas, preproducción y producción con Docker, Podman, Git y SSH, con despliegues documentados que el equipo puede repetir y revisar.
  • Dentro del proyecto AgoraData lidero el desarrollo de la interfaz web que sirve de front-end a todo el backend y a los procesos Python de ImpulsaDATA, con Java, Spring Boot, Vaadin y PostgreSQL. Coordino y delego seguridad, pruebas, accesibilidad y CI/CD.
  • Participo en el refuerzo de seguridad de CKAN (actualizaciones, cifrado TLS, cabeceras y cookies) y verifico cada corrección con pruebas antes de cerrarla.
  • Acompaño a perfiles en prácticas y junior, documento las decisiones técnicas y convierto el conocimiento del equipo en guías reutilizables.
  • Uso flujos de trabajo agénticos con IA (Claude, Codex y Copilot) en desarrollo, pruebas end-to-end y revisión de código, con reglas y contexto que mantienen la trazabilidad.
Tragsatec

Tragsatec

Jun 2025 – Sept 2025

Ingeniero de Datos (Prácticas) · ImpulsaDATA

Albacete, España

datos.gob.es

Primera etapa en ImpulsaDATA, centrada en diseñar y desarrollar la primera versión de la herramienta de conversión de metadatos del proyecto.

  • Diseñé y desarrollé la primera versión de la herramienta de conversión de metadatos del proyecto, un proceso ETL en Python que adapta la información al estándar europeo de datos abiertos y la publica en CKAN.
  • Añadí configuración externa, registros de ejecución y documentación para que el equipo pudiera operar, revisar y mantener la herramienta con facilidad.
La Fábrica del Tiempo

La Fábrica del Tiempo

Feb 2024 – Ago 2024

Ingeniero de Datos y Automatización (Prácticas)

Albacete, España

Integración de datos y automatización de procesos con Power Platform y Microsoft 365 en una empresa de consultoría y productividad.

  • Desarrollé con Power Apps una aplicación interna que centraliza en un único lugar la gestión de procesos e información de la empresa.
  • Automaticé con Power Automate la gestión de leads, notificaciones y aprobaciones, conectando SharePoint, el CRM y Microsoft 365, con una mejora de más del 25 % en la eficiencia de los procesos tratados.
  • Formé al equipo en las nuevas herramientas y preparé contenido técnico para facilitar su adopción en el trabajo diario.
Ayuntamiento de Alcázar de San Juan

Ayuntamiento de Alcázar de San Juan

Mar 2019 – Jun 2019

Técnico Informático (Prácticas)

Alcázar de San Juan, España

Soporte técnico y mantenimiento informático en un entorno de administración pública.

  • Di soporte técnico a los usuarios municipales y resolví incidencias de hardware, software y red en un entorno de administración pública.
  • Mantuve equipos e infraestructura básica, apoyé la administración de sistemas y documenté las incidencias para agilizar su seguimiento.
Soporte ITSistemasRedes

Big Data y cloud aplicados

Proyectos académicos aplicados con arquitectura, ejecución, evidencias y limitaciones

Dashboard de Databricks con tasa de churn, precisión del modelo, calibración y rendimiento por segmento
Big Data · MLOps2026
Proyecto académico aplicado

Lakehouse y MLOps de churn telco

Plataforma de datos de principio a fin, desarrollada en coautoría, que predice la baja de clientes de una operadora con datos sintéticos usando PySpark, Delta Lake, Unity Catalog y MLflow.

DatabricksDelta LakeMLflowUnity Catalog
Ver caso
Dashboard Streamlit con KPIs de ocupación, mapa de plazas en tiempo real y estado por sub-zona
Cloud · IoT2026
Proyecto académico aplicado

Smart Parking Albacete

Plataforma IoT en la nube que recoge en tiempo real los datos de 40 sensores de aparcamiento simulados y los publica en un panel web, con AWS Lambda, DynamoDB y MQTT.

AWS IoTLambdaDynamoDBStreamlit
Ver caso
Diagrama: SQL Server, CSV y Kafka alimentan Spark, orquestado por Airflow, que escribe capas Bronze, Silver y Gold de Delta Lake sobre MinIO
Data Engineering2026
Proyecto académico aplicado

Plataforma de datos Spark, Kafka y Airflow

Procesa datos por lotes y en tiempo real con Spark, Kafka y Airflow y los organiza en capas de calidad creciente (arquitectura Medallion) sobre Delta Lake.

SparkAirflowKafkaDelta Lake
Ver caso

Stack técnico

Gobernanza y calidad del dato

IA aplicada y calidad

AI harness engineeringContext engineeringAutomatización de flujos técnicosPruebas end-to-end asistidasRevisión técnica de códigoDocumentación reproducible

Gestión e idiomas

PMI / CAPMKanbanADOCCEspañol (nativo)Inglés B2

Formación y certificaciones

Project Management Institute
Certificación

CAPM

Project Management Institute

Fundamentos certificados de dirección de proyectos PMI.

Hablemos

Abierto a oportunidades en ingeniería de datos, gobernanza del dato y plataformas de datos.

Señal pública de GitHub

Estadísticas de código

Actividad pública actualizada en cada despliegue desde GitHub.

Abrir perfil de GitHub

GitHub de Alonso Marcos Muñoz

Commits (2026)
208
Pull requests
21
PR fusionadas
95,2%
Issues totales
59
Contribuciones (últimos 12 meses)
313
95%merge

Lenguajes más usados

Porcentaje de bytes de código en repositorios públicos propios.

  • Jupyter Notebook26,8%
  • Python24,8%
  • TeX19,6%
  • TypeScript10,8%
  • HTML7,7%
  • Astro3,9%

Solo actividad públicaIncluye la actividad de mi cuenta anterior @AlonsoMarcosMActualizado 30 sept 2026GitHub API