Kursplan
Inledning
- Hur SRE förenar traditionell IT med programvaruutveckling.
- Behovet av automation och observerbarhet
- Rollerna för programvaruingenjörer jämfört med systemadministratörer.
- Site Reliability Engineers jämfört med DevOps-ingenjörer.
Översikt över ett IT-system
- Systemarkitektur, on-premise och molnbaserad.
Översikt över SRE-principer och praxis
- Infrastruktur som kod (Infrastructure as Code).
- Rollerna för containerisering och orkestrering (Docker, Kubernetes etc.)
- Kontinuerlig integration, kontinuerlig distribution och kontinuerlig leverans.
- Observerbarhet.
Bedömning av ett IT-system
- Inventering av lagets och organisationens resurser.
- Kartläggning av system och processer.
- Utgången för SRE:s potentiella inverkan.
- Rollerna för programvaruutvecklingsteamet.
- Rollerna för driftteamet.
- Rollerna för ledningen.
Underhåll av systemets tillförlitlighet
- Beskrivning och mätning av önskad tillförlitlighet för en tjänst.
- Förståelse för Service Level Objectives (SLO:er)
- Förståelse för Service Level Indicators (SLI:er) och Service Level Agreements (SLA:er).
- Arbete med felbudgetar (Error Budgets).
- Utveckling av ett SLO.
Optimering av systemadministration
- Upprättandet av en utvecklingsmiljö
- Utvärdering av SRE-verktyg
- Prioritering av uppgifter för automation.
- Skrivande av programvara.
Deployment av "Infrastruktur som kod"
- Testning och iterering av kod
- Göra systemet antifragilt
- Lära sig av misslyckanden
Övervakning av ett system
- Observation av systemprestanda.
- SRE-verktyg och tekniker.
Framtiden för SRE
Krav
- En allmän förståelse av IT-infrastruktur.
- En allmän bild av utvecklingsprocessen för programvara.
- Erfarenhet av programmering eller skriptning på vilken som helst språk.
Målgrupp
- Utvecklare
- Systemadministratörer
- Programvaruarkitekter
- DevOps-ingenjörer
- IT-chefer
Vittnesmål (7)
Hur detaljerade ämnen förklaras med exempel från den verkliga världen
Brian Hlabane - African Bank
Kurs - Site Reliability Engineering (SRE) Fundamentals
Maskintolkat
Hon är expert på området och ger verkligen bra utbildning. Materialet, utbildningen var verkligen en blandning av exempel, diskussioner och
Peter Tutka - Deutsche Telekom IT & Telecommunications Slovakia s.r.o.
Kurs - Site Reliability Engineering (SRE) Fundamentals
Maskintolkat
En vy på SRE/DevOps från ett mer affärs- och teoretiskt perspektiv. Mest användbar för personer som redan har den praktiska uppfattningen.
Michael Varhol - Deutsche Telekom IT & Telecommunications Slovakia s.r.o.
Kurs - Site Reliability Engineering (SRE) Fundamentals
Maskintolkat
Träningens ansats att skicka ut enkät innan träningen så att den kunde planeras enligt deltagarnas förväntningar. Det gör deltagarna mer aktiva.
Stefan Girman - Deutsche Telekom IT & Telecommunications Slovakia s.r.o.
Kurs - Site Reliability Engineering (SRE) Fundamentals
Maskintolkat
Att hålla sig till den ursprungliga undersökningen från deltagarna om vad som ska vara fokus för utbildningen.
Denis Majorsky - Deutsche Telekom IT & Telecommunications Slovakia s.r.o.
Kurs - Site Reliability Engineering (SRE) Fundamentals
Maskintolkat
diskussioner, SRE-definition
Daniel Horvath - Deutsche Telekom IT & Telecommunications Slovakia s.r.o.
Kurs - Site Reliability Engineering (SRE) Fundamentals
Maskintolkat
Konceptet för utbildningen, att hålla deltagarna engagerade genom att ställa frågor och utlösa diskussioner. Samarbetsgrupperna var också en bra metod för att tänka igenom saker i grupper och se olika resultat från andra grupper.
Blazej Farkas - Deutsche Telekom IT & Telecommunications Slovakia s.r.o.
Kurs - Site Reliability Engineering (SRE) Fundamentals
Maskintolkat