I am a Data Engineer with extensive 6 years experience in building Big Data systems to provide a Unified Analytics Platform. With expertise in conceptualizing and implementing data pipelines, I am responsible for converting data into informational insights thus helping the organization to make data-driven decisions.
My experience in various industries includes Trading & Food and Beverage Services & Banking domains.
Key Competencies:
↗️Designing Big Data ETL Pipelines
↗️Building a Unified Analytics Platform
↗️Design Thinking
↗️Optimize the Job Execution Time
↗️Strategy Planning and Implementation
↗️Communication
Technologies:
➡️AWS Cloud & Azure Cloud Services
➡️Apache Spark Programming
➡️PySpark Programming
➡️SQL for Data Analysis
➡️Simplify Data analysis With Python
➡️Manage Clusters Databricks.
➡️Data Extraction and Transformation and Load Databricks & Hadoop)
➡️Linux Commands
➡️Job Scheduling using Apache Airflow
➡️Data Ingestion for Apache Sqoop
➡️Data Warehouse Software for reading, writing and managing large data set files using Apache Hive.
➡️Experience with version controls for GitHub, Bitbucket
➡️Jenkins for automate the parts of software development related to building, testing, and deploying, facilitating CI/CD.
Key Achievements:
✅Microsoft-Certified-Azure-Data-Fundamentals (DP-900)
✅Microsoft-Certified-Azure-Data-Engineer-Associate (DP-203)
✅ Databricks Certificated Associate Developer for Apache Spark.
(Databricks Community)
✅AWS Certificated Developer - Associate
✅AWS Certificated Cloud Practitioner
Worked on the optimization of Spark-based Data Integration framework performance using best practices which resulted in performance improvement.