Systems PhD Software Engineer

Databricks is a data and AI platform that lets organizations build analytics, AI agents, and applications on a unified, governed lakehouse.

160 Spear Street, Suite 1300, San Francisco, CA 94105, United States
About Databricks

Data engineers, analysts, and AI teams use Databricks to process large datasets, build reliable pipelines, and train models on a single governed platform. Users can run SQL analytics, serve ML predictions in real time, and deploy AI agents grounded in enterprise data. Its open lakehouse architecture provides consistent security and governance across analytical and operational workloads.

View jobs by Databricks

Skills

Candidate Availability

Required and preferred rules are kept separate and reflect the wording in the original posting.

About the Role

You will design and implement advanced database-engine capabilities, including query compilation, distributed query execution, vectorized processing, data security, resource management, transaction coordination, storage structures, and physical data optimization.

Requirements

  • PhD in databases or systems
  • Knowledge of database systems, storage systems, distributed systems, language design, or performance optimization

Responsibilities

  • Design and implement query compilation and optimization capabilities
  • Build distributed query execution and scheduling systems
  • Develop vectorized engine execution
  • Improve data security and resource management
  • Implement transaction coordination and efficient storage structures
  • Develop automatic physical data optimization

Benefits

  • Annual performance bonus eligibility
  • Equity