Expertise observabilité

Observabilité & Monitoring

Des métriques aux traces, des logs aux dashboards — une maîtrise complète de la stack d'observabilité moderne.

La stack

Métriques

Prometheus, Thanos (multi-cluster), Metricbeat — collecte et agrégation à grande échelle.

Traces

Tempo, Alloy — tracing distribué pour applications micro-services.

Logs

ELK Stack (Elasticsearch, Logstash, Kibana) — centralisation et analyse de logs.

Visualisation

Grafana — dashboards techniques et métier, alerting visuel.

Alerting

Alertmanager — règles SLI/SLO, notification multi-canal.

Réalisations

Plateforme centralisée pour agence spatiale

Conception et déploiement d'une plateforme d'observabilité unifiée couvrant l'infrastructure, les métiers et les équipements spécialisés (stockage sur bande, métriques S3). Développement de collecteurs Python sur mesure, consolidation dans Grafana pour une vue unique.

Consolidation multi-cluster cloud

Pour une plateforme SaaS multi-clusters sur cloud public : unification de tous les clusters Kubernetes via Thanos + stockage S3, dashboard global couvrant l'infrastructure et les micro-services.

Supervision multi-clients on-prem

Plateforme d'observabilité multi-clusters on-prem avec dashboards par client : CPU, mémoire, réseau, stockage Ceph, Kubernetes. Architecture scalable pour monter en charge.

Vous voulez améliorer votre observabilité ?