Распределённая платформа Control Center

От одного сервера до нескольких площадок — в одной модели управления.

Control Center объединяет topology, роли узлов, размещение нагрузок, ёмкость, обслуживание, сетевую конфигурацию и восстановление. Платформа не просто показывает состояние — она заранее проверяет условия операции, рассчитывает безопасный вариант и контролирует фактический результат.

Multi-nodeSites, Zones, роли узлов и placement.
Capacity IntelligenceРезерв, bottleneck, прогноз и what-if.
Safe OperationsDrain, maintenance, replace и canary updates.
HA & RecoveryQuorum, PITR, Recovery Points и object recovery.
Multi-node и Capacity

Платформа понимает, где и почему должна работать нагрузка.

Решения по размещению и расширению инфраструктуры опираются на фактическую топологию, здоровье узлов, ограничения сервисов и доступный запас ресурсов.

NODE

Роли узлов, Sites и Zones

Каждый узел получает понятную роль и область ответственности. Площадки и зоны используются для делегирования, отказоустойчивости и безопасного размещения сервисов.

  • Node Roles и topology-aware assignment
  • Sites / Zones / scopes и delegated administration
  • Desired / Actual State ownership
  • Health и schedulable state
PLACE

Placement Planner

Control Center выбирает допустимый узел с учётом нагрузки, роли, площадки, зоны, health, anti-affinity и доступной ёмкости. Stateful-сервисы перемещаются только при наличии безопасного migration path.

  • Role / Site / Zone constraints
  • Capacity и dominant utilization
  • Anti-affinity и topology checks
  • Execution-time revalidation
CAP

Capacity Planner

Платформа рассчитывает текущий и безопасный резерв, в том числе после потери крупнейших узлов, выявляет узкое место и показывает, где запас инфраструктуры заканчивается раньше всего.

  • Safe capacity и reserve
  • Bottleneck identification
  • Evidence и confidence
  • Рекомендации по размещению и расширению
AI-CAP

Capacity Intelligence

История телеметрии используется для прогноза роста и what-if анализа: что произойдёт при добавлении роли, увеличении нагрузки, выводе узла или изменении аппаратной конфигурации.

  • Growth forecast
  • What-if planning
  • Hardware recommendations
  • Self-calibration по реальным метрикам
Lifecycle и обновления

Обслуживание узла начинается с проверки, а не с выключения.

Control Center планирует Drain, Maintenance, Replace и обновления как управляемые операции. Перед изменением проверяется, куда можно безопасно перенести нагрузки и сохраняется ли работоспособность control plane.

1Preflight

Проверка health, capacity, topology и зависимостей.

2Drain

Безопасная эвакуация допустимых нагрузок.

3Maintenance

Узел переводится в обслуживаемое состояние без новых placements.

4Canary update

Обновление начинается с минимальной волны и health-check.

5Rollback / Continue

При ошибке rollout останавливается; при PASS продолжается по rings.

Upgrade Orchestrator

Строит canary-first rollout по dependency graph и update rings, учитывает maintenance window, допустимый parallelism и quorum контроллеров.

Canary-firstUpdate RingsQuorumHealth Gates

Replace без потери контекста

Замена узла рассматривается как lifecycle-операция: роли, placements, состояние и зависимости сохраняются в общей модели, а новое размещение проходит повторную проверку.

ReplaceRole ReassignmentPlacementAudit
Site Autonomy и сеть

Площадка продолжает работать, даже если связь с центром нестабильна.

Site Controller хранит локально необходимое состояние и синхронизирует его после восстановления связи. Network & Security Manager управляет интерфейсами и сетевыми политиками с обязательной защитой от потери доступа.

SITE

Site Autonomy

Локальная площадка сохраняет рабочее состояние и выполняет разрешённые локальные операции при потере WAN. После reconnect синхронизация учитывает версии объектов и правила разрешения конфликтов.

  • Local state store
  • Top-down Desired / bottom-up Actual sync
  • WAN-loss operation
  • Conflict-aware reconciliation
NET

Multi-NIC, WAN и LAN

Сервер может одновременно выполнять несколько сетевых ролей. Интерфейсы получают назначение, а маршрутизация и firewall применяются в контексте зон и сервисов.

  • WAN / LAN interface roles
  • Routing, VLAN и bonding
  • Firewall policy
  • NAT и port-forwarding только при явном включении
EDGE

Edge Gateway

Пограничный узел управляется как часть платформы: сетевые роли, маршруты, firewall и публикация сервисов связаны с общей моделью health, audit и recovery.

  • Gateway role
  • Service exposure policy
  • Network health
  • Audit и change history
SAFE

Connectivity auto-rollback

Сетевые изменения выполняются staged. После применения Control Center проверяет связность и автоматически возвращает предыдущую конфигурацию, если управление узлом или критический путь связи потерян.

  • Staged network changes
  • Connectivity checks
  • Automatic rollback
  • Safe remote administration
HA, DR и Recovery

Восстанавливается не только сервер. Восстанавливается нужный уровень системы.

Control Center объединяет отказоустойчивость control plane, резервные копии, PITR и восстановление отдельных объектов. Это позволяет выбирать подходящий сценарий — от потери узла до случайного удаления данных оператором или приложением.

HA

Quorum и fencing

HA-операции учитывают quorum и защищаются fencing-механизмами, чтобы автоматическое восстановление не создавало split-brain и конкурирующие активные состояния.

  • Quorum / consensus
  • Fencing
  • Controlled failover / failback
  • Health-based recovery decisions
DB

PostgreSQL HA и PITR

Платформа поддерживает HA-провайдер базы данных, Backup Repository и point-in-time recovery для возврата к нужному моменту состояния.

  • PostgreSQL HA provider
  • Backup Repository
  • PITR
  • Restore drills
OBJ

Object Recovery

Восстановление может выполняться на уровне конкретного объекта, а не только всей базы или сервера. Это полезно при случайном удалении пользователя, учётной записи, политики или другого управляемого объекта.

  • Recovery Points
  • Object-level restore
  • Operator-error recovery
  • Application-error recovery
SLA

RPO / RTO

Сценарии защиты и восстановления связываются с измеримыми RPO и RTO. Restore drills проверяют, что заявленный сценарий действительно воспроизводится.

  • RPO / RTO targets
  • Recovery evidence
  • Restore verification
  • DR runbooks

Все операции остаются в одной модели Control Center.

RBAC, Change, Approval, Job, Audit, Health и Recovery применяются одинаково — от одного узла до распределённой инфраструктуры.