Get in Touch
 Duration 7 hours

Course Outline

1. Introduction to Distributed PostgreSQL

  • Addressing scaling limitations in single-node PostgreSQL setups
  • Introduction to the Citus extension: its objectives, structure, and core elements
  • Essential concepts: coordinator nodes, worker nodes, metadata, and distribution keys

2. Cluster Architecture and Configuration

  • Differentiating node roles: coordinator versus workers
  • Table classifications: distributed, replicated, and local tables
  • Implementation and setup of Citus within existing PostgreSQL environments
  • Cluster discovery processes and node administration

3. Data Distribution and Sharding Approaches

  • Sharding techniques: hash-based versus append-based methods
  • Choosing an appropriate distribution column to maximize performance
  • Administering distributed and replicated tables
  • Shard re-balancing and strategies for scaling out

4. Distributed Query Execution and Optimization

  • Understanding how Citus directs and parallelizes query execution
  • Analyzing distributed query execution plans
  • Query pushdown mechanisms and execution refinement

5. Consistency, Transactions, and Fault Tolerance

  • Two-Phase Commit (2PC) and ensuring atomicity in operations
  • Managing failures within distributed transactions

6. Operational Management and Real-World Applications

  • Utilizing monitoring tools and system views specific to Citus
  • Managing maintenance tasks and upgrades in distributed settings

Requirements

  • Completion of the Advanced Administration (High Availability & Replication) module or comparable professional experience
  • A strong command of PostgreSQL configuration and performance tuning techniques
  • Basic proficiency in Linux and fundamental networking concepts

Target Audience

Skilled Database Administrators, DevOps Engineers, and System Architects who oversee production PostgreSQL environments and seek to achieve horizontal scaling

Testimonials (2)

Related Categories