Engineering Resources

Cloud Data Engineering

Large-scale data engineering uses parallel processing frameworks such as Apache Spark and managed data platforms such as Databricks.

Enterprise pipelines can adopt a Lakehouse design, organizing data into Bronze, Silver and Gold layers on Amazon S3 or Azure Data Lake Storage, with Delta Lake for managed tables.

Data Platform Optimization and FinOps

Engineering work for Itaú Unibanco included Glue and PySpark data workloads. Query design, execution planning and resource selection are key concerns when controlling data-platform costs.