Mise à l’échelle automatique avec KEDA
Comprenez les stratégies de déclenchement, activez KEDA, vérifiez les ScaledObjects générés et planifiez la capacité.
Supervision avec Prometheus
Configurez le pipeline de métriques utilisé par les déclencheurs de mise à l’échelle automatique basés sur Prometheus.
Dimensionnement
Exigences en CPU, en mémoire et en nombre de pods par pool de nœuds pour les installations minimales et de production.
Métadonnées des charges de travail supplémentaires
Appliquez des surcharges avancées par chart, telles que le nombre de réplicas, à des charges de travail Vantage individuelles.
Prérequis
Étiquetez et marquez (taint) les nœuds de travail TechCore et d’entraînement.
Résolution des problèmes
Diagnostiquez les ScaledObjects défaillants, les métriques indisponibles et les échecs d’ordonnancement.
Principes de capacité
- Considérez les totaux de requêtes indiqués sur la page Sizing comme un seuil minimal d’installation, et non comme une garantie de dimensionnement pour la production.
- Effectuez des tests avec des documents, des compétences, des niveaux de simultanéité et des exigences de latence représentatifs.
- Surveillez conjointement le nombre de réplicas souhaité par le HPA et les pods en attente afin de ne pas confondre les problèmes de déclenchement avec les problèmes de capacité du cluster.
- Dimensionnez les pools de nœuds, les quotas, les registres et le stockage de façon à prendre en charge une scalabilité simultanée sur plusieurs services.
- Maintenez les charts
vantage-operatoretvantage-selfhostedà la même version afin que leur configuration de mise à l’échelle automatique reste compatible.
