Technology & Tools: Python, AWS Glue, Amazon Redshift, Snowflake, Amazon S3, Athena,
CloudFormation, PySpark, Spark SQL, CloudWatch, AWS Cost Optimization
Role: Data Engineer
• Built pipelines to process and analyze AWS usage and cost data using Glue, PySpark, S3,
Athena, Redshift, and Snowflake.
• Designed Data Lake and Data Warehouse workflows for cost visibility, reporting,
performance analysis, and cloud cost optimization.
• Applied Redshift optimization concepts including query tuning, distribution and sort
strategies, workload management, storage optimization, and Serverless vs. provisioned
workload considerations.
• Implemented scalable partitioning and query patterns and supported operational
monitoring using Amazon CloudWatch.
• Used AWS CloudFormation and GitHub Actions for repeatable infrastructure
provisioning and CI/CD-based deployments.