Show Notes
- Amazon Sweden Store: https://www.amazon.se/dp/149192912X?tag=9natreeswe-21
- Amazon Worldwide Store: https://global.buys.trade/Site-Reliability-Engineering%3A-How-Google-Runs-Production-Systems-Jennifer-Petoff.html
- Apple Books: https://books.apple.com/us/audiobook/site-reliability-engineering-how-google-runs-production/id1573412970?itsct=books_box_link&itscg=30200&ls=1&at=1001l3bAw&ct=9natree
- eBay: https://www.ebay.com/sch/i.html?_nkw=Site+Reliability+Engineering+How+Google+Runs+Production+Systems+Jennifer+Petoff+&mkcid=1&mkrid=711-53200-19255-0&siteid=0&campid=5339060787&customid=9natree&toolid=10001&mkevt=1
- Läs mer: https://swedish.9natree.com/read/149192912X/
#Tjänstenivåmål,SLO #Felbudgetar #Toilgräns #Blamelesspostmortems #Incidenthantering #SiteReliabilityEngineering
Site Reliability Engineering: How Google Runs Production Systems är en fackbok från 2016, redigerad av Betsy Beyer, Chris Jones, Jennifer Petoff och Niall Richard Murphy. Den samlar essäer från Googles SRE-organisation och beskriver hur företaget behandlar drift av digitala tjänster som ett programvaruproblem. I stället för att skilja utveckling från drift ska ingenjörer bygga, mäta och förbättra systemen under hela deras livslängd. Boken är både en introduktion till SRE som arbetssätt och en tekniskt orienterad handbok för storskaliga distribuerade system. Den rör sig från principer, som enkelhet och riskhantering, till konkreta områden som övervakning, jourarbete, incidenthantering, kapacitetsplanering och förändringshantering. Ett centralt syfte är att visa hur pålitlighet kan göras mätbar och hur team kan undvika att fastna i återkommande manuellt driftarbete. Perspektivet är tydligt präglat av Googles miljö och skala, men kärnan är bredare. Boken förklarar hur tydliga mål, automatisering och lärande efter fel kan förena snabb produktutveckling med stabila tjänster.