
Search by job, company or skills
Greetings from TCS!!
TATA Consultancy Services is hiring for Pyspark Developer
Desired experience range: 4 to 8 years
Job location: Hyderabad, Chennai, Kolkata, Mumbai, Bhubaneswar and Pune
Job description:
As a Data Engineer, you will be responsible for designing, developing, and maintaining data solutions for data generation, collection, and processing in Big Data
environment using predominantly PySpark/Python. Your typical day will involve creating data pipelines, ensuring data quality, and implementing ETL processes to
migrate and deploy data across systems using PySpark.
Roles & Responsibilities:
· Design, develop, and maintain robust, scalable high-performance Data Pipelines using PySpark.
· Create data pipelines, ensuring data quality, and implement ETL processes to migrate and deploy data across systems.
· Migrate Ab Initio ETL Applications into Pyspark based data pipelines
· Migrate On Prem workloads into Cloud(AWS, Databricks, Snowflake) based on use cases.
· Collaborate with cross-functional teams to identify and resolve data-related issues.
· Stay updated with the latest advancements in data engineering and integrate innovative approaches for sustained competitive advantage.
Qualifications:
• 4+ years of professional experience in Hadoop, PySpark/Python development.
• Proven expertise in PySpark and experience in handling huge volume of data
• 3+ working experience in AWS, Databricks/Snowflake, Airflow
• Familiarity with CI/CD pipelines and version control systems (e.g., Git).
• Strong debugging and problem-solving skills.
• Excellent communication and collaboration skills.
Job ID: 151955019
Skills:
Pyspark, Spark SQL, Python Scripting, Machine Learning, Data Modeling, Cloud Services, Data Warehousing, Scala Programming
Skills:
Pyspark, Databricks, Python, AWS
Skills:
data wrangling , Data pipeline, Concurrency, Core Python, Pyspark, Exception Handling, Apis, Data Loading, Debugging, Oop, Git, Numpy, Pandas, Restful Services, Unit tests, Decorators, Dataframes, Lambda Functions, Error handling, Parallel Processing, DB connectivity, Gen AI, Vector operations, apply map functions, applymap
Skills:
data wrangling , Concurrency, Data Pipeline, Python, Pyspark, Apis, Debugging, Oop, Numpy, Git, Pandas, Exception Handling, Data Loading, Restful Services, Decorators, Dataframes, Parallel Processing, Lambda Functions, Error Handling, Vector Operations, Applymap, Gen Agentic AI, Apply Map Functions, Unit Tests, DB Connectivity