dataprof
File, DataFrame e stream Arrow. Report che esplicitano cosa è stato davvero valutato.
CIAO, MONDO. FAI COME SE FOSSI A CASA.
Data engineer, sviluppatore open source e sperimentatore instancabile. Lavoro dove si incontrano pipeline dati, storage e strumenti per sviluppatori, di solito con Rust, Python o Go.
Dai un’occhiataStrumenti che costruisco, mantengo e da cui imparo. Il codice è a disposizione.
File, DataFrame e stream Arrow. Report che esplicitano cosa è stato davvero valutato.
Raccolta di open data: da fonti disordinate a dataset utilizzabili.
Collega decisioni, incidenti e ragioni dei cambiamenti. La conoscenza resta in Git.
Pipeline lakehouse, mart e controlli di qualità eseguibili. Verificati anche in locale con DuckDB.
Ingestion supervisionata, eventi durevoli e benchmark edge riproducibili.
Dal laboratorio, estate 2026: Lares · Fantabuddy · OCCAS · Esperimento sui commit Iceberg
Ricerca e benchmark riproducibili: Nephtys / UIC 2026 · dataprof / ScalCom 2026
Contribuisco correzioni e miglioramenti agli strumenti che uso, tra cui Apache Arrow, DataFusion, Iceberg Rust, Polars e Tokio.
Segui le mie contribuzioni →Esperimenti, cose che si sono rotte e quello che ho imparato.
Infrastrutture dati, open source o un bel problema tecnico da esplorare: scrivimi.