Построить
Три manager, два worker, overlay-сеть, три HTTP-реплики и Registry 2.
Пять изолированных узлов, три manager и два worker. Реплицированный HTTP-сервис и Registry с TLS и авторизацией прошли baseline, потерю worker, потерю follower-manager и повторную проверку после восстановления.
Граница доказательства: это собственный контролируемый локальный process proof, не клиентский кейс и не доказательство для чужой production-среды.Controlled local process proof, not a client case and not evidence about a third-party production environment.
Сначала фиксируется здоровое состояние. Затем намеренно останавливается ровно один узел, проверяется сходимость и доступность, узел возвращается, а финальный read-only gate повторяется.
Три manager, два worker, overlay-сеть, три HTTP-реплики и Registry 2.
Короткоживущий CA, TLS-сертификат и bcrypt htpasswd передаются как Swarm secrets.
Сначала worker-1, затем follower manager-2 — с ожиданием авторитетного статуса Down.
Топология, кворум, реплики и оба endpoint проходят повторяемый read-only verifier.
Проверка не ограничивалась строкой “service up”: сохранены состояния узлов и текущих задач именно в момент каждого отказа.
worker-1|Down. Все три актуальные задачи proof_health зафиксированы Running на worker-2; HTTP endpoint вернул 200.
manager-2|Down|Unreachable. Leader остался доступен, а сервисы сохранили состояния proof_health|3/3 и proof_registry|1/1.
JSON-отчёты содержат условия, узлы, сервисы, endpoints и результат каждой проверки. Текстовые снимки фиксируют состояние внутри fault window.
NODE_STATE_WHILE_WORKER_1_STOPPED manager-1|Ready|Leader manager-2|Ready|Reachable manager-3|Ready|Reachable worker-1|Down| worker-2|Ready| DESIRED_RUNNING_TASKS_WHILE_WORKER_1_STOPPED proof_health.1|worker-2|Running 2 seconds ago proof_health.2|worker-2|Running 18 seconds ago proof_health.3|worker-2|Running 18 seconds ago
Сценарий генерирует новый случайный пароль и runtime-ключи при каждом запуске. Ни пароль, ни private keys, ни join tokens не записываются в публичные результаты.
9/9 checks: node counts, readiness, leader, manager reachability, replicas and both endpoints.
Открыть baseline.json ↗Тот же полный gate после возвращения остановленных узлов в Ready.
Открыть recovered.json ↗Состояние пяти узлов и размещение трёх running tasks в fault window.
Открыть worker evidence ↗Кворум-сигналы и replica state при недоступном follower-manager.
Открыть manager evidence ↗Compose, stack, fault runner, verifier и шесть unit-тестов собраны в одной папке.
Открыть README ↗SHA-256 для четырёх опубликованных evidence-файлов.
Открыть checksums ↗