project
Enterprise data lake on GCP
Architected an enterprise data lake with a metadata-driven PySpark framework, schema versioning, and reusable data-quality patterns.
tag
2 items Β· 1 project Β· 1 feed item
Architected an enterprise data lake with a metadata-driven PySpark framework, schema versioning, and reusable data-quality patterns.
A practical pattern for turning scattered technical knowledge into queryable metadata: stable identities, version history, clear ownership, and views people can actually use.