От одного сервера до нескольких площадок — в одной модели управления.
Control Center объединяет topology, роли узлов, размещение нагрузок, ёмкость, обслуживание, сетевую конфигурацию и восстановление. Платформа не просто показывает состояние — она заранее проверяет условия операции, рассчитывает безопасный вариант и контролирует фактический результат.
Платформа понимает, где и почему должна работать нагрузка.
Решения по размещению и расширению инфраструктуры опираются на фактическую топологию, здоровье узлов, ограничения сервисов и доступный запас ресурсов.
Роли узлов, Sites и Zones
Каждый узел получает понятную роль и область ответственности. Площадки и зоны используются для делегирования, отказоустойчивости и безопасного размещения сервисов.
- Node Roles и topology-aware assignment
- Sites / Zones / scopes и delegated administration
- Desired / Actual State ownership
- Health и schedulable state
Placement Planner
Control Center выбирает допустимый узел с учётом нагрузки, роли, площадки, зоны, health, anti-affinity и доступной ёмкости. Stateful-сервисы перемещаются только при наличии безопасного migration path.
- Role / Site / Zone constraints
- Capacity и dominant utilization
- Anti-affinity и topology checks
- Execution-time revalidation
Capacity Planner
Платформа рассчитывает текущий и безопасный резерв, в том числе после потери крупнейших узлов, выявляет узкое место и показывает, где запас инфраструктуры заканчивается раньше всего.
- Safe capacity и reserve
- Bottleneck identification
- Evidence и confidence
- Рекомендации по размещению и расширению
Capacity Intelligence
История телеметрии используется для прогноза роста и what-if анализа: что произойдёт при добавлении роли, увеличении нагрузки, выводе узла или изменении аппаратной конфигурации.
- Growth forecast
- What-if planning
- Hardware recommendations
- Self-calibration по реальным метрикам
Обслуживание узла начинается с проверки, а не с выключения.
Control Center планирует Drain, Maintenance, Replace и обновления как управляемые операции. Перед изменением проверяется, куда можно безопасно перенести нагрузки и сохраняется ли работоспособность control plane.
Проверка health, capacity, topology и зависимостей.
Безопасная эвакуация допустимых нагрузок.
Узел переводится в обслуживаемое состояние без новых placements.
Обновление начинается с минимальной волны и health-check.
При ошибке rollout останавливается; при PASS продолжается по rings.
Upgrade Orchestrator
Строит canary-first rollout по dependency graph и update rings, учитывает maintenance window, допустимый parallelism и quorum контроллеров.
Replace без потери контекста
Замена узла рассматривается как lifecycle-операция: роли, placements, состояние и зависимости сохраняются в общей модели, а новое размещение проходит повторную проверку.
Площадка продолжает работать, даже если связь с центром нестабильна.
Site Controller хранит локально необходимое состояние и синхронизирует его после восстановления связи. Network & Security Manager управляет интерфейсами и сетевыми политиками с обязательной защитой от потери доступа.
Site Autonomy
Локальная площадка сохраняет рабочее состояние и выполняет разрешённые локальные операции при потере WAN. После reconnect синхронизация учитывает версии объектов и правила разрешения конфликтов.
- Local state store
- Top-down Desired / bottom-up Actual sync
- WAN-loss operation
- Conflict-aware reconciliation
Multi-NIC, WAN и LAN
Сервер может одновременно выполнять несколько сетевых ролей. Интерфейсы получают назначение, а маршрутизация и firewall применяются в контексте зон и сервисов.
- WAN / LAN interface roles
- Routing, VLAN и bonding
- Firewall policy
- NAT и port-forwarding только при явном включении
Edge Gateway
Пограничный узел управляется как часть платформы: сетевые роли, маршруты, firewall и публикация сервисов связаны с общей моделью health, audit и recovery.
- Gateway role
- Service exposure policy
- Network health
- Audit и change history
Connectivity auto-rollback
Сетевые изменения выполняются staged. После применения Control Center проверяет связность и автоматически возвращает предыдущую конфигурацию, если управление узлом или критический путь связи потерян.
- Staged network changes
- Connectivity checks
- Automatic rollback
- Safe remote administration
Восстанавливается не только сервер. Восстанавливается нужный уровень системы.
Control Center объединяет отказоустойчивость control plane, резервные копии, PITR и восстановление отдельных объектов. Это позволяет выбирать подходящий сценарий — от потери узла до случайного удаления данных оператором или приложением.
Quorum и fencing
HA-операции учитывают quorum и защищаются fencing-механизмами, чтобы автоматическое восстановление не создавало split-brain и конкурирующие активные состояния.
- Quorum / consensus
- Fencing
- Controlled failover / failback
- Health-based recovery decisions
PostgreSQL HA и PITR
Платформа поддерживает HA-провайдер базы данных, Backup Repository и point-in-time recovery для возврата к нужному моменту состояния.
- PostgreSQL HA provider
- Backup Repository
- PITR
- Restore drills
Object Recovery
Восстановление может выполняться на уровне конкретного объекта, а не только всей базы или сервера. Это полезно при случайном удалении пользователя, учётной записи, политики или другого управляемого объекта.
- Recovery Points
- Object-level restore
- Operator-error recovery
- Application-error recovery
RPO / RTO
Сценарии защиты и восстановления связываются с измеримыми RPO и RTO. Restore drills проверяют, что заявленный сценарий действительно воспроизводится.
- RPO / RTO targets
- Recovery evidence
- Restore verification
- DR runbooks
Все операции остаются в одной модели Control Center.
RBAC, Change, Approval, Job, Audit, Health и Recovery применяются одинаково — от одного узла до распределённой инфраструктуры.