Get in Touch
 Duration 7 hours

Course Outline

1. Introduction to Distributed PostgreSQL

  • Scaling limitations of single-node PostgreSQL
  • Introduction to the Citus extension: objectives, architecture, and core components
  • Core concepts: coordinator node, worker nodes, metadata, and distribution keys

2. Cluster Architecture and Setup

  • Node roles: distinguishing between coordinators and workers
  • Table categories: distributed, replicated, and local tables
  • Installation and configuration of Citus within existing PostgreSQL environments
  • Cluster discovery processes and node management

3. Data Distribution and Sharding Strategies

  • Sharding techniques: comparing hash and append methods
  • Choosing a distribution column for maximum performance
  • Administering distributed and replicated tables
  • Rebalancing shards and scaling out capabilities

4. Distributed Query Execution and Optimization

  • How Citus routes and parallelizes query execution
  • Interpreting distributed query plans
  • Query pushdown techniques and execution optimization

5. Consistency, Transactions, and Fault Tolerance

  • Two-Phase Commit (2PC) mechanisms and atomic operations
  • Managing failures within distributed transactions

6. Operational Management and Use Cases

  • Monitoring tools and views available for Citus
  • Maintenance procedures and upgrades in distributed environments

Requirements

  • Completion of the Advanced Administration (High Availability & Replication) course or possession of equivalent experience
  • Proficient knowledge of PostgreSQL configuration and performance optimization
  • Basic familiarity with Linux and fundamental networking concepts

Target Audience

This course is designed for experienced Database Administrators, DevOps Engineers, and System Architects who currently manage production PostgreSQL environments and require strategies for horizontal scaling.

Number of participants


Price per participant

Testimonials (2)

Upcoming Courses

Related Categories