AlberrDev Data Workspace

Software Engineer construyendo sistemas de datos fiables.

Experiencia en productos de datos, backend y APIs. Creciendo hacia Data Engineering, ML Engineering y AI Engineering.

Alberto Martinez
profile.yamlactive
nameAlberto Martinez
handleAlberrDev
focusdata-engineering
statuslearning / building
Foco actualData Engineering
Tecnologías principalesPython · SQL · DuckDB
UbicaciónMurcia, España

01 / identidad

Sobre mí

Soy una persona en constante búsqueda de la mejora, con una mente curiosa y una pasión genuina por aprender. Me gusta enfrentarme a problemas complejos, entender cómo funcionan las cosas y convertir ese conocimiento en soluciones útiles, mantenibles y bien estructuradas.

Mi recorrido comenzó en el desarrollo de software y actualmente oriento mi crecimiento hacia Data Engineering, ML Engineering y AI Engineering. Me interesa trabajar con datos de forma rigurosa y construir sistemas fiables.

Ingeniería del Software, mención en Ingeniería de Datos e Inteligencia ArtificialU-tad · online · desde septiembre de 2024
Python · SQL · DuckDB · ParquetEspañol nativo · Inglés C1 · Alemán básico

02 / catálogo

Proyectos

Proyectos que conectan datos, software y aprendizaje práctico.

01En desarrollo

Data Pipeline Platform

Pipeline reproducible para practicar ingesta, transformación, calidad e idempotencia.

En desarrollo
PythonDuckDBParquet
Próximamente
02Completado

House Price Prediction

Proyecto de regresión con EDA, feature engineering y evaluación sobre 100.000 filas.

R² 0,8567
Pythonpandasscikit-learn
Ver en GitHub
03En desarrollo

Data API

Proyecto de API centrado en acceso fiable a datos procesados, validación y contratos claros.

Planificado
Node.jsPostgreSQLREST
Próximamente

03 / sistemas

Experiencia

Agosto 2024 - actualidadactual

Software Engineer · BIUWER

Dataprep / Data Engineering

  • Desarrollo end-to-end de funcionalidades con autonomía completa en una plataforma visual de workflows de datos.
  • Migración de procesamiento desde tablas intermedias de ClickHouse a DuckDB y Parquet con NDJSON y VARIANT.
  • Stress tests locales de hasta 70 millones de filas y 8-9 ramas simultáneas; reducción aproximada del 84% en un benchmark local de formato.
  • Implementación end-to-end de autenticación y autorización con Authentik y OIDC.
  • Diseño de APIs REST con TypeORM y PostgreSQL, storage con SeaweedFS y AWS SDK, y tests con Vitest.
  • Implementación y revisión de conectores para distintas fuentes y formatos de datos.
DuckDBClickHouseParquetREST APIsPostgreSQL
Biuwer Analytics / Product Engineering
  • Desarrollo de Data Portals con contenido visual, menús jerárquicos y drag and drop.
  • Construcción de un Design System con Storybook para documentación y testing aislado.
  • Mejora media del rendimiento del 15% en producción con Redis y TTL.
Marzo 2024 - junio 2024

Full Stack Developer · Capgemini

ADCenter

  • Participación en una plataforma para centralizar la gestión de proyectos, equipos y vacantes.
  • Trabajo con Java, Spring Boot, JOOQ, JDBC, CQRS, RabbitMQ, React, TypeScript, Redux, Keycloak y Scrum.

04 / stack

Capacidades

Tecnologías y prácticas utilizadas en proyectos de datos, backend y producto.

Datos

PythonSQLDuckDBClickHouseParquetNDJSONVARIANTPostgreSQLMySQLMongoDB

Backend y APIs

TypeScriptNode.jsExpressRESTTypeORMJavaSpring BootJWTOAuth2/OIDCAuthentikRedis

Ingeniería

Docker / ComposeSeaweedFSAWS SDKGitCI/CDVitestClean ArchitectureHexagonal ArchitectureVertical Slicing

Frontend y producto

ReactAstroTailwind CSSStorybookDesign Systems

05 / credenciales

Certificaciones

Certificaciones y formación que acompañan mi transición hacia la ingeniería de datos.

Ver credencial

Databricks Data Engineer Associate

Objetivo recomendado después de consolidar SQL, Python y un pipeline práctico.

Objetivo futuro

Databricks Professional Data Engineering

Siguiente objetivo para profundizar en ingeniería de datos a escala profesional.

Objetivo futuro

06 / roadmap

Aprendizaje

Actualmente profundizo en SQL analítico, pipelines de datos, orquestación, cloud y MLOps.

En progreso
Formación actualIngeniería del Software, mención en Ingeniería de Datos e Inteligencia ArtificialU-tad · online · desde septiembre de 2024
01

Ingesta

Capturar datos desde conectores y fuentes heterogéneas con contratos claros y una entrada reproducible.

Ver experiencia

07 / conexión

Contacto

Si quieres hablar sobre datos, APIs o una oportunidad de colaboración, puedes encontrarme aquí.