Métriques
Prometheus, Thanos (multi-cluster), Metricbeat — collecte et agrégation à grande échelle.
Des métriques aux traces, des logs aux dashboards — une maîtrise complète de la stack d'observabilité moderne.
Prometheus, Thanos (multi-cluster), Metricbeat — collecte et agrégation à grande échelle.
Tempo, Alloy — tracing distribué pour applications micro-services.
ELK Stack (Elasticsearch, Logstash, Kibana) — centralisation et analyse de logs.
Grafana — dashboards techniques et métier, alerting visuel.
Alertmanager — règles SLI/SLO, notification multi-canal.
Conception et déploiement d'une plateforme d'observabilité unifiée couvrant l'infrastructure, les métiers et les équipements spécialisés (stockage sur bande, métriques S3). Développement de collecteurs Python sur mesure, consolidation dans Grafana pour une vue unique.
Pour une plateforme SaaS multi-clusters sur cloud public : unification de tous les clusters Kubernetes via Thanos + stockage S3, dashboard global couvrant l'infrastructure et les micro-services.
Plateforme d'observabilité multi-clusters on-prem avec dashboards par client : CPU, mémoire, réseau, stockage Ceph, Kubernetes. Architecture scalable pour monter en charge.