andrea bozzo / personal home page
WORLD WIDE WEB / PERSONAL EDITIONRUST · PYTHON · GO
hello_world.txt

CIAO, MONDO. FAI COME SE FOSSI A CASA.

Sono Andrea.
Do un senso
ai dati.

Data engineer, sviluppatore open source e sperimentatore instancabile. Lavoro dove si incontrano pipeline dati, storage e strumenti per sviluppatori, di solito con Rust, Python o Go.

Dai un’occhiata
Continuo a esplorare e costruire.100% PERSONAL
projects/

Qualche progetto dal laboratorio

Strumenti che costruisco, mantengo e da cui imparo. Il codice è a disposizione.

dataprof

File, DataFrame e stream Arrow. Report che esplicitano cosa è stato davvero valutato.

Rust · Python · Arrow

Ceres + Ares

Raccolta di open data: da fonti disordinate a dataset utilizzabili.

Rust · Open data

GitNodes

Collega decisioni, incidenti e ragioni dei cambiamenti. La conoscenza resta in Git.

Rust · Git · MCP

dlt + dbt

Pipeline lakehouse, mart e controlli di qualità eseguibili. Verificati anche in locale con DuckDB.

Python · Databricks

Nephtys

Ingestion supervisionata, eventi durevoli e benchmark edge riproducibili.

Go · NATS · Edge
Altri progetti ed esperimenti
  • Lares: Infrastruttura domestica noiosa e ripristinabile.
  • Lakekeeper: Un catalogo Iceberg REST in Rust con credenziali vended, OpenFGA e un'impronta operativa piccola.
  • IcebergSharp: Un reader Iceberg .NET in sviluppo: prima metadati e catalogo.
  • Fantabuddy: Uno storico calcistico locale e un report da portare all’asta, anche offline.
  • OCCAS: Collegare la telemetria di volo reale alle condizioni in cui è stata prodotta.
  • Iceberg stale-base reproduction: Una piccola riproduzione di un problema importante nella semantica dei commit.
  • Mercury: Un sistema di ricerca sui dati di mercato che parte dall’osservazione.
  • Mosaico: Lavoro di contribuzione su una piattaforma dati open per robotica e AI fisica.
  • Zero Grappler: Pipeline async minimali sensor-to-inference no_std per Rust embedded.
  • DCE: Enforcement proattivo dei data contract costruito dal core di profilazione di dataprof.
  • Open Lakehouse Starter: Uno stack lakehouse per piccoli team con dlt, dbt, Superset e MinIO.
  • Peek-a-Boo: Un agente AI minimalista per ricerca chirurgica e estrazione su file.
  • Lance Bridge: Indicizzazione semantica da stream di eventi live verso LanceDB senza tirare su un database vettoriale separato.
  • druid-datafusion-bridge: Interroga i segmenti Apache Druid direttamente attraverso DataFusion.
  • DataPizza AI: Un framework Python GenAI per agenti e pipeline RAG pronti per la produzione, con astrazione minima.
  • Questo piccolo sito: Una homepage personale con lo spirito del vecchio web e poca manutenzione.
Tutti i repository su GitHub ↗

Dal laboratorio, estate 2026: Lares · Fantabuddy · OCCAS · Esperimento sui commit Iceberg

Ricerca e benchmark riproducibili: Nephtys / UIC 2026 · dataprof / ScalCom 2026

Mi trovi anche upstream

Contribuisco correzioni e miglioramenti agli strumenti che uso, tra cui Apache Arrow, DataFusion, Iceberg Rust, Polars e Tokio.

Segui le mie contribuzioni →
appunti / blog

Hai qualcosa di interessante?

Infrastrutture dati, open source o un bel problema tecnico da esplorare: scrivimi.

HOME PAGE PERSONALEOPEN SOURCE INSIDEUN WEB PIÙ PERSONALECODICE SORGENTE ↗