Aller au contenu principal

05 — Sizing, HA et Déploiement Multi-Sites

Audience : Architectes infrastructure, Ingénieurs Broadcom
Référence : 🔒 docs.broadcom.com — VCF Automation 9.1 (connexion Broadcom requise)


1. Topologies de déploiement

1.1 Vue d'ensemble des options

TopologieNœudsLBHAUsage
Simple / Single Node1Internal (intégré)❌ Non HALab, Dev, POC
Cluster 3 Nœuds3Externe obligatoire✅ HAProduction
Multi-Site Actif/Passif3+3Externe par site✅ DRProduction critique

2. Sizing par topologie

2.1 Topologie Simple (1 nœud)

RessourceSmallNotes
vCPU4Dédié, pas d'overcommit recommandé
RAM16 GBMinimum absolu
Disque OS60 GB thinPhoton OS 5.0
Disque Data150 GBDonnées applicatives
Réseau1 vNIC × 1 GbpsRéseau Management

⚠️ Single node = zéro résilience. En cas de panne : service totalement indisponible.

2.2 Topologie Cluster 3 Nœuds — Par nœud

TaillevCPURAMDisque OSDisque DataUsage
Small416 GB60 GB150 GBPetite production (< 500 objets)
Medium832 GB100 GB250 GBProduction standard (500-2000 objets)
Large1664 GB150 GB500 GBGrande production (> 2000 objets)
X-Large24128 GB200 GB1 TBTrès grande échelle

Total cluster Medium : 3 × (8 vCPU + 32 GB + 100 GB + 250 GB)
= 24 vCPU + 96 GB RAM + 300 GB OS + 750 GB Data

2.3 VCF Services Runtime (K8s mutualisé)

Le VCF Services Runtime héberge tous les composants management (Fleet LC, Salt, licserver...).
Il est partagé entre les services et n'est pas dédié à VCF Automation.

TaillevCPU totalRAM totalIPs requisesUsage
Small12 vCPU48 GB12 IPs contigusLab / Petite prod
Medium24 vCPU96 GB24 IPs contigusProduction standard
Large48 vCPU192 GB30 IPs contigusGrande production

2.4 Sizing total — Recommandation Production Standard

ComposantvCPURAMStockage
VCF Automation × 3 nœuds (Medium)2496 GB1050 GB
VCF Services Runtime (Medium)2496 GB500 GB
VCF Operations (Medium cluster)48192 GB2 TB
VCF Operations Cloud Proxy × 2412 GB120 GB
SDDC Manager824 GB200 GB
NSX Manager × 31248 GB600 GB
TOTAL Management Domain~120 vCPU~470 GB~4.5 TB

💡 Règle de base : Prévoir un cluster Management Domain de minimum 4 hôtes avec HA activé pour absorber la défaillance d'un hôte.


3. Configuration HA (Haute Disponibilité)

3.1 HA VCF Automation — Cluster 3 nœuds

Comportement en cas de panne :

  • Panne d'1 nœud : Cluster continue de fonctionner (quorum 2/3)
  • Panne de 2 nœuds : Service interrompu (quorum perdu)
  • Recovery automatique : Kubernetes reschedule les pods sur les nœuds disponibles

3.2 Configuration vSphere HA pour VCF Automation

Paramètre vSphere HARecommandation
vSphere HAActivé (tolère panne hôte)
Admission ControlRéserve 33% (1 hôte de N)
VM Restart PriorityHigh pour nœuds VCF Automation
Anti-Affinity RulesRègle DRS : les 3 nœuds sur des hôtes différents
Datastore HAvSAN avec FTT=1 minimum

3.3 Configuration Load Balancer — Recommandations

Paramètre LBValeur recommandée
AlgorithmeRound Robin ou Least Connections
Health CheckHTTPS port 443 /health
Session PersistenceSource IP (recommandé)
Timeout300 secondes (5 min) minimum
SSL TerminationPass-through (LB ne décrypte pas)
Ports443 (HTTPS), 8443 (API interne)

Options LB supportées

  • NSX Load Balancer (recommandé dans VCF)
  • F5 BIG-IP
  • HAProxy
  • Citrix NetScaler / ADC
  • AWS ALB/NLB (pour déploiements hybrides)
  • ⚠️ Tout LB Layer 4/7 supportant TCP 443 et health checks HTTPS

4. Déploiement Multi-Sites

4.1 Architecture Active/Passive (DR)

Notes pour l'architecture DR :

  • VCF Automation ne supporte pas un mode actif/actif natif entre sites
  • Le DR repose sur la restauration depuis les backups SFTP sur le site de reprise
  • RTO typique : 2-4 heures (restauration backup SFTP)
  • RPO : 15 minutes (fréquence backup incrémental)

4.2 Latences inter-sites

Exigences réseau VCF pour déploiements multi-sites :

LienLatence maximaleBande passante min.
Entre nœuds VCF Automation (cluster)< 5 ms1 Gbps
VCF Automation → vCenter< 10 ms1 Gbps
VCF Automation → NSX Manager< 10 ms1 Gbps
VCF Automation → SFTP Backup< 50 ms100 Mbps
Site Principal → Site DR< 100 ms100 Mbps

4.3 Multi-VCF Instances (Fleet)

VCF Automation supporte la gestion de plusieurs VCF Instances (Multi-VCF Fleet) :

  • 1 instance VCF Automation peut gérer plusieurs vCenters/NSX dans différents VCF Instances
  • Ajout de Cloud Accounts additionnels pour chaque VCF Instance ou cloud public
  • Recommandation : 1 VCF Automation par Fleet (ensemble des VCF Instances)
VCF Fleet
├── VCF Automation 9.1 (site principal)
│ ├── Cloud Account: vCenter Site A (Management Domain)
│ ├── Cloud Account: vCenter Site A (Workload Domain 1)
│ ├── Cloud Account: vCenter Site B (Workload Domain 2)
│ ├── Cloud Account: NSX Site A
│ ├── Cloud Account: NSX Site B
│ └── Cloud Account: AWS Production

5. Placement des VMs — Règles DRS

5.1 Anti-Affinity obligatoires

RègleVMsRaison
Anti-affinity VCF AutomationNode 1, Node 2, Node 3HA — hôtes distincts
Anti-affinity VCF Services RuntimeNœuds K8s RuntimeRésilience K8s
Anti-affinity NSX ManagersNSX-1, NSX-2, NSX-3HA NSX

5.2 Recommandations de placement

Hôte 1: VCF Automation Node 1 + NSX Manager 1 + SDDC Manager
Hôte 2: VCF Automation Node 2 + NSX Manager 2 + VCF Operations Node 1
Hôte 3: VCF Automation Node 3 + NSX Manager 3 + VCF Operations Node 2
Hôte 4 (spare HA): VCF Operations Node 3 + Services Runtime Nodes

6. Capacité de VCF Automation — Limites supportées

MétriqueSmallMediumLarge
Projets (Organizations)50200500+
Cloud Templates50020005000+
Déploiements actifs50020005000+
Cloud Accounts1050100+
Utilisateurs1005001000+
Pipelines CI/CD20100500+
ABX Actions50200500+

7. Recommandations selon profil client

ProfilTopologie recommandéeSizingNotes
Petite entreprise (< 100 VMs gérées)Single NodeSmallLab/dev uniquement si pas de SLA
Entreprise moyenne (100-500 VMs)Cluster 3 nœudsSmallHA production
Grande entreprise (500-2000 VMs)Cluster 3 nœudsMediumStandard prod
Grand compte (> 2000 VMs)Cluster 3 nœudsLargeOptimisation perf
Multi-DC critique2 × Cluster 3 nœudsMediumActif/Passif avec SFTP répliqué
Cloud hybride intensifCluster 3 nœudsLargeNombreux cloud accounts

8. Dimensionnement Stockage SFTP Backup

ScénarioEstimation backup/jourRétention 30 jours
Small (50 projets, 500 déploiements)~5 GB full + 500 MB incrémentaux~45 GB
Medium (200 projets, 2000 déploiements)~20 GB full + 2 GB incrémentaux~200 GB
Large (500 projets, 5000 déploiements)~50 GB full + 5 GB incrémentaux~500 GB

📖 Termes spécifiques VCF 9 : GLOSSARY.md

Précédent → 04_upgrade_paths.md
Suivant → 06_ports_network.md