Statut

Tous les systèmes sont opérationnels.

Les cinq composants tiennent leurs objectifs en ce moment : l'API, le provisionnement, les paiements, les données de couverture et le support. Si cela change, cette page bouge dans les cinq minutes qui suivent la déclaration de l'incident, et si nous savons qui est touché, nous t'aurons contacté avant que tu le lises ici.

Une page de statut ne vaut quelque chose que si elle accepte de dire quelque chose de mauvais. Celle ci est mise à jour pendant l'incident et non après, ce qui veut dire que tu verras parfois la mention en cours d'investigation à côté d'un composant alors que nous ne savons toujours pas pourquoi.

Composants

ComposantÉtatObjectifEn ce moment
APIOpérationnel99,9 pour cent de disponibilitéAucune erreur au dessus du niveau de référence sur les 24 dernières heures
ProvisionnementOpérationnel99,5 pour cent des commandes payées aboutissent à un profil fonctionnelL'heure glissante est au dessus de l'objectif, installation médiane en 41 secondes
PaiementsOpérationnelAutorisation et remboursement automatique en moins de 60 secondesLe prestataire signale un fonctionnement normal et les remboursements partent à l'heure
Données de couvertureOpérationnelChiffres publiés rafraîchis chaque jour, plancher de 25 mesures respectéLe dernier rafraîchissement est terminé et aucun pays n'est masqué pour cause de données trop anciennes
SupportOpérationnelPremière réponse en moins de 60 secondes, 24 heures sur 24La file est dans l'objectif dans toutes les langues couvertes

Opérationnel veut dire que le composant tient son objectif sur l'heure glissante. Ce n'est pas une promesse sur l'heure suivante.

99,5 %

objectif de réussite du provisionnement

60 s

remboursement automatique quand le provisionnement échoue

30 min

durée d'incident qui déclenche un post mortem public

72 h

délai pour publier ce post mortem

Ce que signifie chaque état

ÉtatCe que cela signifieCe que nous faisons
OpérationnelLe composant tient son objectif sur l'heure glissanteRien. C'est l'état normal et ce n'est pas une promesse sur l'avenir
Performances dégradéesCela fonctionne, mais plus lentement ou moins bien que l'objectifNommé sur cette page, clients touchés contactés, avoirs appliqués sans demande
Panne partielleEn échec pour un groupe identifiable, par exemple un opérateur ou une régionLe groupe est nommé, les achats sont bloqués là où ils échoueraient, les remboursements partent automatiquement
Panne majeureEn échec de façon généraleUn responsable d'incident est désigné et une mise à jour tombe au moins toutes les 30 minutes jusqu'à la résolution
MaintenanceTravaux prévus avec une fenêtre connueAnnoncés au moins 72 heures à l'avance et programmés sur l'heure la moins chargée

Il n'existe aucun état qui veuille dire ça va, sans doute. Soit le composant tient son objectif, soit il est nommé sur cette page.

La politique en cas d'incident

Deux engagements portent l'ensemble, et les deux sont inconfortables à dessein. Le premier : nous prévenons les clients touchés avant qu'ils s'en rendent compte. Le second : tout ce qui dépasse 30 minutes donne lieu à un post mortem écrit et publié sous 72 heures.

Le post mortem nomme des systèmes et des décisions, pas des salariés, et il est rédigé par la personne qui était d'astreinte, pas par un manager qui raconte quelqu'un d'autre.

Si nous allons dépasser le délai de 72 heures, nous publions le retard et sa raison dans les 72 heures, parce qu'un délai manqué et annoncé tard, cela fait deux échecs.

  • La détection est automatique à partir des taux de réussite du provisionnement et d'autorisation des paiements, donc un incident commence quand les chiffres bougent, pas quand quelqu'un se plaint
  • L'état du composant sur cette page change dans les cinq minutes qui suivent la déclaration, avant que la cause soit connue
  • Un responsable d'incident pilote la réponse et une autre personne s'occupe de la communication, pour qu'aucune des deux tâches n'étouffe l'autre
  • Les clients touchés sont identifiés et contactés, avec un avoir déjà appliqué là où le service était dégradé, plutôt que proposé sur demande
  • Les achats sont bloqués sur tout parcours dont nous savons qu'il échouerait, parce qu'encaisser un paiement que nous devrons rembourser est pire que perdre la vente
  • Pendant une panne majeure, une mise à jour tombe au moins toutes les 30 minutes, même quand la mise à jour dit que nous ne savons toujours pas
  • Dans les 72 heures après la résolution, un post mortem est publié avec une chronologie, l'impact client en chiffres, la cause, et chaque correctif avec un responsable et une date
Ton téléphone
Opérateur Asaturé, 4 Mbps
Opérateur Bfluide, 61 Mbps
Basculé, sans rien te demander
Un opérateur unique ne peut pas faire ce basculement. C'est toute la raison pour laquelle nous achetons chez plusieurs.
Quand un territoire compte plusieurs réseaux partenaires, la congestion te fait changer de réseau au lieu de devenir un incident.

Pourquoi l'objectif n'est pas cent pour cent

Parce qu'un réseau est dans la boucle et que cent pour cent serait un mensonge. Un objectif de provisionnement de 99,5 pour cent dit tout haut qu'environ cinq commandes sur mille échoueront quelque part entre le paiement et le profil fonctionnel.

Ce qui compte, c'est que le chemin de ces cinq là soit conçu. Le remboursement part en moins de 60 secondes sans ticket, le message explique ce qui s'est passé et quoi essayer à la place, et personne n'a à décider si le client le mérite.

La même logique vaut pour la couverture. Quand un réseau partenaire est saturé dans un territoire que nous couvrons avec plusieurs opérateurs, nous te déplaçons plutôt que d'ouvrir un incident, et la note indique quel changement a été fait.

Quand il n'y a qu'un seul réseau et qu'il passe une mauvaise journée, nous le disons sur la page pays. Nos pages de couverture publient la médiane, le dixième le plus lent et le nombre de mesures exactement pour cette raison.

Historique des incidents

Aucun incident de plus de 30 minutes n'a été déclaré sur la période couverte.

Cette phrase vaut exactement ce que vaut notre volonté de la changer, et c'est pour cela que la politique ci dessus est écrite avec autant de détail. Chaque post mortem passé reste publié définitivement au lieu de disparaître au bout de quatre vingt dix jours.

Les questions que l'on nous pose vraiment

Que veut dire opérationnel exactement ici ?
Que le composant tient son objectif en ce moment, pas que rien n'a jamais raté. Le provisionnement est opérationnel quand les commandes payées aboutissent à des profils fonctionnels au niveau de l'objectif de 99,5 pour cent ou au dessus, sur l'heure glissante.
À quelle vitesse cette page se met elle à jour pendant un incident ?
L'état du composant bouge dans les cinq minutes qui suivent la déclaration de l'incident, avant que nous connaissions la cause. Tu liras donc parfois en cours d'investigation plutôt qu'une explication. Nous préférons être tôt et vagues que tard et bien rangés.
Est ce que vous me contactez, ou dois je surveiller cette page ?
Nous te contactons. Si nous pouvons identifier qui est touché, tu as de nos nouvelles avant de t'en rendre compte, avec l'avoir déjà appliqué. Cette page existe pour tous les autres et pour ceux qui veulent le détail.
Quand publiez vous un post mortem ?
Sous 72 heures pour tout incident de plus de 30 minutes. Il contient une chronologie, l'impact client en chiffres, la cause, et les correctifs avec responsables et dates. Si nous allons le publier en retard, nous publions à l'heure le retard et sa raison.
Et si je ne peux pas charger cette page parce que je n'ai plus de données ?
C'est exactement le cas autour duquel tout ce produit est construit. Chaque compte comprend 100 Mo par mois de données de secours gratuites dans 145 pays, donc tu peux ouvrir cette page, joindre le support et acheter un forfait même avec un solde vide. Le support répond en moins de 60 secondes, à n'importe quelle heure.
Les problèmes d'un opérateur dans un pays apparaissent ils ici ?
Oui, sous la forme de données de couverture en performances dégradées avec le pays nommé. Là où nos partenaires ont plusieurs réseaux sur un territoire, nous te basculons vers l'opérateur le plus dégagé sans rien demander, et la note d'incident indique quel changement a été fait.