Coinbase indique qu'une mise à jour de routine de son infrastructure a désactivé une passerelle réseau essentielle, perturbant ainsi les virements, les achats par carte bancaire et les services sur la blockchain pendant environ 50 minutes. Son nouveau rapport d'analyse post-incident explique l'origine de l'erreur et les raisons pour lesquelles les outils de reprise habituels de l'entreprise ont également échoué.
Coinbase explique comment une erreur de configuration a provoqué une interruption de service de 50 minutes

Points clés
- Coinbase a attribué cette interruption de 50 minutes à un conflit de noms de ressources Kubernetes non détecté lors d’une mise à jour de routine de l’infrastructure.
- L’incident a perturbé les virements, les achats par carte de débit Coinbase Card, les règlements institutionnels et les services sur la blockchain sur plusieurs plateformes.
- Cette panne a également désactivé le processus de restauration habituel de Coinbase, ce qui a conduit à la mise en place de nouvelles mesures de sécurité et à des modifications de l’infrastructure.
Coinbase explique ce qui s’est passé
La plateforme d’échange de cryptomonnaies Coinbase (Nasdaq : COIN) a identifié l’erreur logicielle à l’origine de la panne de la semaine dernière, qui a empêché les clients d’effectuer des virements, de réaliser des achats avec la Coinbase Card et d’accéder à plusieurs services sur la blockchain pendant environ 50 minutes.
Selon un rapport d'analyse publié le 21 juillet, les ingénieurs déployaient ce qui semblait être une mise à jour de routine à faible risque lorsqu'un conflit de noms de ressources Kubernetes, passé inaperçu, a entraîné la modification d'un composant réseau erroné. Coinbase a déclaré :
« Ce problème a été causé par une erreur de configuration involontaire d’un composant réseau important, à la suite d’une mise à jour de configuration de routine. À aucun moment les fonds des clients n’ont été menacés. »
Kubernetes est un logiciel utilisé par Coinbase pour organiser et exécuter des applications au sein de son infrastructure cloud. Le conflit de noms de ressources a conduit la mise à jour à modifier une partie de la passerelle d’entrée Istio de l’entreprise au lieu de se limiter au composant visé. Cette passerelle agit comme un contrôleur de trafic, acheminant les requêtes entre les services internes de Coinbase.
Une fois la passerelle mise hors ligne, les systèmes chargés de traiter les transactions, les virements, les règlements et les autorisations de paiement n’ont plus pu communiquer entre eux.
Cartes refusées et virements bloqués
Cette perturbation a affecté les plateformes grand public, institutionnelles et destinées aux développeurs de Coinbase entre environ 12 h 37 et 13 h 25 (heure de l’Est). Certains clients particuliers n’ont pas pu effectuer de dépôts, de retraits ou de transactions hors plateforme. Les virements déjà en cours semblaient bloqués, mais ont été traités après le rétablissement du service. Les achats par carte de débit Coinbase ont été refusés, tandis que les achats par carte de crédit se sont poursuivis. La panne a également interrompu les échanges sur la chaîne via Coinbase DEX sur Base et Solana. Les clients de Coinbase Exchange et Prime ont subi des retards ou des échecs dans leurs virements et règlements, tandis que les clients de la plateforme pour développeurs n’ont pas pu enregistrer de nouveaux utilisateurs, transférer des fonds ou utiliser les services d’accès.
Cet incident souligne l’importance croissante de la fiabilité à mesure que Coinbase étend ses activités au-delà du trading au comptant de cryptomonnaies. Ses produits « everything exchange » prévus, notamment les actions tokenisées et les contrats à terme perpétuels, élargissent l’éventail des activités financières dépendant de l’infrastructure de l’entreprise.
Coinbase a par ailleurs décrit son intention de faire de la plateforme une place financière plus large, avec de nouveaux services de trading, de paiement et de gestion financière couvrant les actions, les produits dérivés, les paiements en stablecoins et les outils pour développeurs. Cette expansion augmente les enjeux en cas de défaillance de l’infrastructure partagée.
Pourquoi la reprise a pris plus de temps que prévu
La passerelle a été rétablie à 13 h 20 (heure de l’Est), et Coinbase a déclaré l’incident maîtrisé trois minutes plus tard. Les retards de traitement des transactions restantes ont été résorbés au cours des heures suivantes. La reprise a pris plus de temps car les outils de déploiement de Coinbase dépendaient de la passerelle défaillante. Les ingénieurs n’ont pas pu utiliser le processus de retour en arrière standard et ont donc lancé manuellement un déploiement d’urgence via le fournisseur de cloud de l’entreprise, en utilisant un accès privilégié temporaire. Coinbase met désormais en place des contrôles pour bloquer les conflits de nommage, sépare les outils de reprise des infrastructures qu’ils gèrent et teste plus régulièrement les procédures d’accès d’urgence. Coinbase a souligné :
« Notre objectif est toujours d’atteindre zéro temps d’arrêt. Nous sommes en train de repenser activement notre infrastructure afin de garantir que, dans l’éventualité hautement improbable d’une nouvelle défaillance comme celle-ci, nous puissions rapidement revenir en arrière et rétablir le service. »
Cet article a été traduit de l'anglais à l'aide de l'IA. La version originale en anglais fait foi ; les traductions automatiques peuvent contenir des inexactitudes, en particulier dans la terminologie juridique et réglementaire.

















