Cloud and Distributed Systems

Cloud infrastructure, distributed coordination, and the reliability tradeoffs behind scaling services across machines, zones, and regions.

AWS Services Cheat Sheet

AWS services grouped by compute, storage, networking, data, and operations roles.

AWSCloud Computing

Big Data Pipeline Cheat Sheet for AWS, Azure, and Google Cloud

Cloud data pipeline stages across ingestion, storage, processing, and serving.

Big DataCloud Computing

Cloud-Native Systems

Cloud native systems assume elastic infrastructure, automation, and failure.

Cloud ComputingMicroservices

High-Availability System Design

High-availability design through redundancy, failover, and degraded operation.

High AvailabilitySystems Atlas

System Design Blueprint

System design blueprint for turning workload constraints into architecture choices.

Interview PreparationSystems Atlas

CAP, BASE, SOLID, and KISS Overview

CAP, BASE, SOLID, and KISS as tradeoff frameworks across system design layers.

Software EngineeringSystems Atlas

Azure Services Cheat Sheet

Azure services grouped by compute, data, networking, identity, and operations roles.

AzureCloud Computing

AWS Services Evolution

AWS evolution from core infrastructure primitives to managed platform services.

AWSCloud Computing

Cloud Load Balancer Cheat Sheet

Cloud load balancer choices across protocol layers, routing, and failure scope.

Cloud ComputingLoad Balancing

Cloud Cost Reduction Techniques

Cloud cost reduction through rightsizing, lifecycle controls, and usage visibility.

Cloud Cost OptimizationResource Management

Hidden Costs of the Cloud

Cloud bills grow through idle resources, egress, request pricing, and retained data.

Cloud CostCost Optimization

Core AWS Services to Learn

Core AWS services grouped by identity, networking, compute, storage, and data.

AWSCloud Computing

6 Cloud Messaging Patterns

Cloud messaging patterns for buffering, fan-out, async work, and cross-service coordination.

Cloud MessagingDesign Patterns

Distributed Lock Use Cases

Distributed locks enforce single-owner work across nodes with expiring leases.

ConcurrencyDistributed Systems

Cloud Monitoring Cheat Sheet

Cloud monitoring signals, storage, alerting, and response across providers.

Cloud ComputingMonitoring

Retry Strategies for Failures

Retry policies for transient failures, backoff, idempotency, and load control.

Distributed SystemsRetry Strategies

Five Unique ID Generators in Distributed Systems

Five ID generation patterns and the tradeoffs between order, scale, and coordination.

Distributed SystemsUnique Ids

The 12-Factor App

The 12-Factor App principles for deployable, configurable, and scalable services.

Application ArchitectureBest Practices

Event Sourcing Integration

Event sourcing through append-only logs, projections, and replayable state.

Event SourcingMicroservices

System Configuration Management

Configuration management through versioned state, IaC, and secret separation.

Configuration ManagementInfrastructure as Code

Infrastructure as Code Landscape Cheat Sheet

Infrastructure as Code tools across provisioning, configuration, and packaging.

DevOpsInfrastructure as Code

Amazon Brazil Build System

Amazon Brazil builds through version sets, package isolation, and reproducibility.

AmazonBuild Systems

Distributed ID Generation

Distributed ID generation tradeoffs across uniqueness, ordering, and scale.

Id GenerationSystems Atlas

Typical AWS Network Architecture

Typical AWS network architecture with VPC, subnet, routing, and edge boundaries.

AWS NetworkingCloud Architecture

Fault-Tolerant Systems Cheat Sheet

Fault-tolerant system design through isolation, redundancy, and controlled failure.

Fault ToleranceSystems Atlas

Web Request Error Handling

Web request error handling through status codes, retries, and failure boundaries.

Error HandlingWeb Requests

Monorepo vs. Microrepo

Monorepos and microrepos compared by coordination cost, tooling, and team autonomy.

MicroservicesMonorepo

System Design Building Blocks

Core system design building blocks for scaling, coordination, and reliability.

ScalabilitySystems Atlas

Architectural Scalability Overview

Architectural scalability through bottleneck analysis, stateless tiers, and partitioning.

ArchitectureScalability

25 Influential Computer Science Papers

Twenty-five papers that shaped computing theory, systems, and networking.

Computer ScienceDistributed Systems

Resilience Patterns

Resiliency patterns that isolate failures, absorb load, and preserve service.

Design PatternsResilience

Scaling a Website to Millions of Users

Website scaling through stateless services, caching, replicas, and partitioning.

ArchitectureScalability

AWS Lambda Performance

Lambda stays fast through pooled capacity, microVMs, and warm reuse.

AWS LambdaServerless

Core System Design Properties

System design balances scalability, availability, reliability, and performance.

ScalabilitySystems Atlas

Leap Seconds in Distributed Systems

Leap second handling in distributed systems with smearing and clock consistency.

Leap SecondsTime Synchronization

Node Failure Detection in Distributed Systems

Distributed failure detection through heartbeats, suspicion, and quorum signals.

Distributed SystemsFailure Detection

6 Idempotency Use Cases

Idempotency patterns for safe retries in writes, payments, messaging, and scheduled work.

Distributed SystemsIdempotency

9 Architectural Patterns for Data and Communication Flow

Architecture patterns for request flow, event fan-out, queues, and peer coordination.

ArchitectureData Flow

Vertical vs. Horizontal Partitioning

Vertical and horizontal partitioning compared by row, column, and scaling needs.

Database PartitioningSharding

Cloud Disaster Recovery Strategies

Cloud disaster recovery through RTO, RPO, backups, and failover patterns.

Cloud ComputingDisaster Recovery

System Design Cheat Sheet

System design tradeoffs and scaling patterns summarised in one cheat sheet.

ScalabilitySystems Atlas

8 Scalability Strategies

Eight scalability strategies across caching, partitioning, replication, and async work.

ScalabilitySystems Atlas

AWS Lambda Internals

AWS Lambda execution through event routing, microVM isolation, and warm reuse.

AWS LambdaServerless