|
| 1 | +"""Compare round-robin and latency-aware reads on a Redis cluster. |
| 2 | +
|
| 3 | +The benchmark injects delay into one replica's client-side command path. This |
| 4 | +keeps the setup small and repeatable while exercising the same async |
| 5 | +``RedisCluster`` selection and measurement paths used in production. |
| 6 | +""" |
| 7 | + |
| 8 | +from __future__ import annotations |
| 9 | + |
| 10 | +import argparse |
| 11 | +import asyncio |
| 12 | +import math |
| 13 | +import time |
| 14 | +from collections import Counter |
| 15 | +from dataclasses import dataclass, field |
| 16 | + |
| 17 | +from redis.asyncio.cluster import ClusterNode, RedisCluster |
| 18 | +from redis.cluster import LoadBalancingStrategy |
| 19 | + |
| 20 | + |
| 21 | +@dataclass |
| 22 | +class Measurements: |
| 23 | + counts: Counter[str] = field(default_factory=Counter) |
| 24 | + latencies: list[float] = field(default_factory=list) |
| 25 | + |
| 26 | + @property |
| 27 | + def p99_ms(self) -> float: |
| 28 | + if not self.latencies: |
| 29 | + return 0.0 |
| 30 | + ordered = sorted(self.latencies) |
| 31 | + index = min(len(ordered) - 1, math.ceil(len(ordered) * 0.99) - 1) |
| 32 | + return ordered[index] * 1000 |
| 33 | + |
| 34 | + |
| 35 | +async def run_mode( |
| 36 | + host: str, |
| 37 | + port: int, |
| 38 | + key: str, |
| 39 | + requests: int, |
| 40 | + concurrency: int, |
| 41 | + delay_ms: float, |
| 42 | + strategy: LoadBalancingStrategy, |
| 43 | + delayed_node_name: str | None, |
| 44 | +) -> tuple[str, Measurements, str]: |
| 45 | + client = await RedisCluster( |
| 46 | + host=host, |
| 47 | + port=port, |
| 48 | + load_balancing_strategy=strategy, |
| 49 | + ) |
| 50 | + slot_nodes = client.nodes_manager.slots_cache[client.keyslot(key)] |
| 51 | + replicas = slot_nodes[1:] |
| 52 | + if not replicas: |
| 53 | + await client.aclose() |
| 54 | + raise RuntimeError("the selected key slot must have at least one replica") |
| 55 | + |
| 56 | + delayed_node = next( |
| 57 | + (node for node in replicas if node.name == delayed_node_name), |
| 58 | + replicas[-1] if delayed_node_name is None else None, |
| 59 | + ) |
| 60 | + if delayed_node is None: |
| 61 | + await client.aclose() |
| 62 | + raise ValueError( |
| 63 | + f"node {delayed_node_name!r} is not a replica for key slot " |
| 64 | + f"{client.keyslot(key)}" |
| 65 | + ) |
| 66 | + |
| 67 | + measurements = Measurements() |
| 68 | + original_execute_command = ClusterNode.execute_command |
| 69 | + |
| 70 | + async def delayed_execute_command(node, *args, **kwargs): |
| 71 | + started = time.perf_counter() |
| 72 | + if args and args[0] == "GET": |
| 73 | + measurements.counts[node.name] += 1 |
| 74 | + if node.name == delayed_node.name: |
| 75 | + await asyncio.sleep(delay_ms / 1000) |
| 76 | + try: |
| 77 | + return await original_execute_command(node, *args, **kwargs) |
| 78 | + finally: |
| 79 | + if args and args[0] == "GET": |
| 80 | + measurements.latencies.append(time.perf_counter() - started) |
| 81 | + |
| 82 | + ClusterNode.execute_command = delayed_execute_command |
| 83 | + try: |
| 84 | + requests_per_worker, remainder = divmod(requests, concurrency) |
| 85 | + |
| 86 | + async def worker(worker_index: int) -> None: |
| 87 | + worker_requests = requests_per_worker + (worker_index < remainder) |
| 88 | + for _ in range(worker_requests): |
| 89 | + await client.get(key) |
| 90 | + |
| 91 | + await asyncio.gather(*(worker(i) for i in range(concurrency))) |
| 92 | + finally: |
| 93 | + ClusterNode.execute_command = original_execute_command |
| 94 | + await client.aclose() |
| 95 | + |
| 96 | + return strategy.value, measurements, delayed_node.name |
| 97 | + |
| 98 | + |
| 99 | +def parse_args() -> argparse.Namespace: |
| 100 | + parser = argparse.ArgumentParser(description=__doc__) |
| 101 | + parser.add_argument("--host", default="127.0.0.1") |
| 102 | + parser.add_argument("--port", type=int, default=6379) |
| 103 | + parser.add_argument("--key", default="{latency-benchmark}:key") |
| 104 | + parser.add_argument("--requests", type=int, default=2000) |
| 105 | + parser.add_argument("--concurrency", type=int, default=32) |
| 106 | + parser.add_argument("--delay-ms", type=float, default=10.0) |
| 107 | + parser.add_argument("--delayed-node") |
| 108 | + return parser.parse_args() |
| 109 | + |
| 110 | + |
| 111 | +async def main(args: argparse.Namespace) -> None: |
| 112 | + if args.requests < args.concurrency: |
| 113 | + raise ValueError("--requests must be at least --concurrency") |
| 114 | + |
| 115 | + for strategy in ( |
| 116 | + LoadBalancingStrategy.ROUND_ROBIN, |
| 117 | + LoadBalancingStrategy.LATENCY_BASED, |
| 118 | + ): |
| 119 | + name, measurements, delayed_node = await run_mode( |
| 120 | + host=args.host, |
| 121 | + port=args.port, |
| 122 | + key=args.key, |
| 123 | + requests=args.requests, |
| 124 | + concurrency=args.concurrency, |
| 125 | + delay_ms=args.delay_ms, |
| 126 | + strategy=strategy, |
| 127 | + delayed_node_name=args.delayed_node, |
| 128 | + ) |
| 129 | + total = sum(measurements.counts.values()) |
| 130 | + delayed_share = measurements.counts[delayed_node] / total * 100 |
| 131 | + print( |
| 132 | + f"strategy={name:<14} delayed_node={delayed_node:<24} " |
| 133 | + f"delayed_share={delayed_share:6.2f}% p99={measurements.p99_ms:8.3f}ms" |
| 134 | + ) |
| 135 | + |
| 136 | + |
| 137 | +if __name__ == "__main__": |
| 138 | + asyncio.run(main(parse_args())) |
0 commit comments