Gestion et gouvernanceService global
CloudWatch
Service de surveillance, collecte de logs et d’événements
Logs
- Collecte, stockage et analyse des logs applicatifs et systèmes
- Intégration avec des instances EC2, d’autres services AWS (lambda, api gateway…) et des applications ou serveurs on-premise
- Concepts clés :
| Concept | Description |
|---|---|
| Log Event | Entrée unique (timestamp + message) |
| Log Stream | Suite d’événements provenant d’une même source |
| Log Group | Ensemble logique de log stream |
| Filter Pattern | Recherche d’événements particuliers |
| Subscription Filter | Redirection des logs vers Lambda, Kinesis ou Firehose (non rétroactif) |
Il est possible d’activer le cross-account monitoring afin de monitorer des applications déployées sur plusieurs comptes AWS
Agent CloudWatch
- Permet d’envoyer :
- des logs personnalisés
- des métriques système avancées (RAM, disque, swap, process)
- Installation possible via SSM, EC2 User Data ou manuellement
- Nécessite un role IAM avec les permissions CloudWatch adéquates
Métriques
- Métriques automatiques pour les services AWS (EC2, RDS, S3, Lambda…) ex CPUUtilization, NetworkIn, DiskReadOps
- Métriques personnalisées (Custom Metrics) :
- Fréquence de collecte : Standard 5 minutes, Détaillée (payante) 1 minute
- Méthodes d’aggrégation : min, max, avg, sum, count
- Détection d’anomalies : seuils dynamiques grâce à des modèles statistiques
Les métriques mémoire/disque EC2 nécessitent le CloudWatch Agent
Dashboards
- Tableaux de bord personnalisables (widgets graphiques)
- Affichage de métriques issues de différents services et régions
Alarmes
- Surveille les métriques et déclenche des actions :
- SNS, Auto Scaling, Lambda, Stop/ Terminate EC2, Step Functions, etc
- Possibilité de combiner plusieurs métriques dans une même alarme
- Anomaly Detection : détection automatique de comportements inhabituels