{"version":"1.0","type":"rich","provider_name":"Acast","provider_url":"https://acast.com","height":250,"width":700,"html":"<iframe src=\"https://embed.acast.com/$/6484c005e432cf001030c493/65e790dbc078ea0015fafd7a?\" frameBorder=\"0\" width=\"700\" height=\"250\"></iframe>","title":"#18 - Natalie Godec - Mettre AWS en PLS","thumbnail_width":200,"thumbnail_height":200,"thumbnail_url":"https://open-images.acast.com/shows/6484c005e432cf001030c493/1709910600491-8d4ef78b56aa42a91e14bd25d3af4bcc.jpeg?height=200","description":"<p>Rares sont ceux qui peuvent se vanter d’avoir “cassé” AWS 🏚️ </p><p>Cette tech fait partie de ce club très fermé. </p><p> </p><p>Cela fait plusieurs mois que Natalie et son équipe en ont ras-le-bol de gérer les incidents Kafka… </p><p>Kafka, c’est ce qu’on appelle un “message broker” ou “bus d’évènements”. </p><p> </p><p>Pour faire simple, c’est un intermédiaire entre vos applis (vos “services”). </p><p> </p><p>En gros, quand un service A veut parler à un service B, il a 2 choix : </p><p>- soit il lui parle en direct… Mais il faut que service B soit prêt et dispo. </p><p>- soit il envoie un message à Kafka, qui le garde au chaud, jusqu’à ce que le service B se décide à écouter </p><p> </p><p>Bref. </p><p>C’est plein de vertus mais j’en parlerai une autre fois. </p><p>C’est surtout souvent TRÈS central dans l’infra. </p><p> </p><p>Et quand ça tombe, plus personne ne peut se parler et donc… Ca pique. </p><p> </p><p>Bon, maintenant revenons à nos moutons. 🐑 </p><p> </p><p>Natalie n’en peut plus de gérer elle-même son Kafka, qui lui fait des misères. </p><p> </p><p>Alors elle décide de déléguer ça à Amazon, via leur offre Amazon “MSK” (”Manage Streaming for Kafka”). </p><p> </p><p>”Je s’occupe de tout, tu s’occupes de rien.” te dit Jeff Bezos. </p><p> </p><p>Et… </p><p>C’est plutôt vrai. </p><p> </p><p>Pendant plusieurs mois, la vie est belle. </p><p> </p><p>Jusqu’au jour où… </p><p>Il faut changer une simple configuration. </p><p>Un tout petit paramètre de rien du tout. </p><p> </p><p>5 minutes plus tard, plus rien ne marche. </p><p>Kafka ne répond plus. </p><p>Impossible de se connecter, même avec ce bon vieux telnet 🤔 </p><p> </p><p>C’est le moment d’employer les grand moyens. </p><p>La fameuse “méthode devops”. 🪄 </p><p>… </p><p>On redémarre. </p><p> </p><p>Sauf que ben… ça redémarre pas. </p><p> </p><p>Et comme c’est Amazon qui gère… </p><p>On peut pas faire grand chose d’autre. 🤷 </p><p> </p><p>Le cluster MSK est cassé. </p><p>Et bien sûr, toute la prod avec. 😱 </p><p> </p><p>Alors comment Natalie Godec s’est-elle sortie de cette situation ? </p><p> </p><p>Vous le saurez en écoutant ce nouvel épisode de Tronche de Tech 🎙️ </p><p> </p><p>Un petit voyage dans le monde de l’infra à ne pas manquer ! </p><p> </p><p>Bonne écoute 🎙️ </p><p> </p><p>PS : dites-nous ce que vous pensez de l'épisode en commentaire (et surtout, abonnez-vous !) </p><p> </p><p>----------------------------------- </p><p> </p><p>Natalie Godec est Senior Cloud Architect chez Zencore. </p><p>Vous pouvez la retrouver sur : </p><p>- Twitter https://twitter.com/ouvessvit </p><p>- Youtube : https://www.youtube.com/channel/UCvrKGfYlJpAjdzT1qazyaiw </p><p>- Linkedin : https://www.linkedin.com/in/natalie-godec </p><p> </p><p>L'article de blog sur l'incident MSK https://aws.plainenglish.io/how-we-broke-our-aws-msk-cluster-7b0a62ccbe53 </p><p> </p><p>--------------------------------- </p><p> </p><p>Je suis Mathieu Sanchez, CTO d'Acasi, et pour me suivre, c'est principalement sur Linkedin : https://www.linkedin.com/in/matsanchez/ </p><p> </p><p>Vous pouvez aussi suivre Tronche de Tech, sur vos réseaux favoris : </p><p>- Linkedin : https://www.linkedin.com/company/tronche-de-tech/ </p><p>- Instagram : https://www.instagram.com/tronchedetech/ </p><p>- TikTok : https://www.tiktok.com/@tronchedetech </p><p>- Twitter : https://twitter.com/TroncheDeTech </p>","author_name":"Mathieu Sanchez"}