Data Analyst Developer – Databricks
Section I - Job Details
Job ID:
Coding:
Mandatory
Experience Level:
Location:
Ahamdabad
/
/
Work Type:
Onsite
/
/
Section II - Job Evaluation Topics and Weight
-
Topic of Evaluation / Skills:
SQL/Spark/Python development on Databricks
(Mandatory)
-
Topic of Evaluation / Skills:
Curated Data Marts & Dashboards (CMS analytics)
(Mandatory)
-
Topic of Evaluation / Skills:
Data Quality, Monitoring & Documentation
(Mandatory)
-
Topic of Evaluation / Skills:
Optimization & Automation (Databricks Workflows)
(Mandatory)
Section III - Job Requirements and Responsibilities
Job Requirements:
-
4–8 years of experience with 3–4 years Databricks/Spark
-
Proficiency in SQL/Spark/Python on Databricks
-
Experience implementing data quality checks, monitoring, and documentation
Key Responsibilities:
-
Develop data transformations using SQL/Spark/Python on Databricks
-
Build curated data marts and dashboards for CMS analytics
-
Implement data quality checks, monitoring, and documentation
-
Optimize queries and automate workloads using Databricks Workflows
-
Collaborate with product owners to convert requirements into insights
Section IV - Job Qualifications & Skills
Domain:
CMS analytics
Soft Skills:
-
Collaboration with product owners
-
Communication
-
Documentation & knowledge sharing
Education Requirements:
Bachelor's/Master's in Computer Science or equivalent (optional/flexible)
Section V - Sample Questions for Training Model
Technical:
-
How do you optimize wide transformations in Spark to avoid shuffles?
-
Explain how you would design a curated data mart for a CMS analytics use
case.
-
What monitoring strategy would you use for Databricks Workflows?
Coding:
-
Write a PySpark job to incrementally upsert records into a Delta table
(MERGE INTO).
-
Given a clickstream dataset, write SQL with window functions to compute
session-level metrics.