gezel Gezel Handboek

Reliability & Resilience Review

Review a codebase for production reliability and resilience risks across asynchronous work, external dependencies, state transitions, resource lifecycles, and recovery paths. Uses the repository and per-file indexes to map failure domains, verifies likely issues in source and tests, and leaves a prioritized morning report covering timeouts, retries, idempotency, cancellation, concurrency, backpressure, cleanup, graceful shutdown, observability, and disaster recovery. Use for a weekly reliability sweep, resilience review, failure-mode audit, or pre-production hardening review.

How it runs

#StepWho runs itWhat happens
1Map failure domainsReviewerinventory stateful and asynchronous boundaries plus their reliability contract
2Verify failure handlingReviewertrace representative failures through source and tests
3Write the reliability reportReviewerranked failure-mode report with concrete hardening work
4EvaluateReviewerGrade the deliverable against every acceptance criterion. All pass → finish; any fail → loop back and fix the gap.
5FinishDeveloperAll acceptance criteria met. Stamp a short summary and report DONE.

Say something like "reliability review" or "resilience audit" or "review failure modes" or "weekly production hardening" or "find reliability risks" or "nightly reliability sweep" in chat to start it.

Needs toolsets: builtin.code-intel, builtin.code-execution.

Watch this article as a slideshow