• Senior Data Engineer having 7 years experience in building large scale data pipelines on cloud with data analysis reports and testing feature importance for ML models. • Expertise in Pyspark in building robust data pipelines, which provide data to data scientists and ML models. • Build features for ML models based on the model requirements which have consistent discussions with data scientists and ML engineers. • Responsible for listing ML models importance based on model performance tests. • Experience in developing applications using Amazon Web Services like EC2, Cloud Search, Elastic Load balancer ELB, S3, CloudFront, Athena, AWS glue, Kinesis, IAM, ECS, RDS, Lambda, CloudWatch, SNS, CloudTrail and cloud formation templates. • Experience in the areas of Data Distribution, Client/Server communication, Multi-threaded applications, Server-side programming, analytical programming using Python and Django • Expertise on Databases such as MYSQL, Oracle, PL/SQL, PostgreSQL and NOSQL databases like MongoDB, Cassandra. • Written Python Scripts, mappers to run on Hadoop distributed file system (HDFS). • Expertise in version control tools like GitHub and Bitbucket.