Source description
About the role
Primary Skills PySpark, Database, SQL, Python, Secondary Skill Starburst ETL Hands on experience of building data pipelines. Proficiency in two or more data integration platforms such as Ab Initio Apache Spark Talend and Information Big Data Experience of big data platforms such as Hadoop, Hive or Snowflake for data storage and process Data Warehousing & Database Management Expertise around Data Warehousing concepts, Relational Oracle, MSSQL, MySQL and NoSQL MongoDBDynamoDB database design Data Modeling & Design Good exposure to data modeling techniques; design, optimization and maintenance of data models and data structures Proficient in one or more programming languages commonly used in data engineering such as Python,Java DevOps Exposure to concepts and enablers - CI/CD platforms, version control,automated quality control management Data Governance A strong grasp of principles and practice including data quality, security, privacy and compliance
More at Virtusa