Kursplan
Introduktion till Apache Spark
- Sparks roll i big data-bearbetning
- Spark-arkitektur och dess komponenter
Inställning Apache Spark
- Krav på maskinvara och programvara
- Installationsprocedurer för fristående lägen och klusterlägen
- Metodtips för konfiguration för systemadministratörer
Administrera Spark-kluster
- Verktyg och tekniker för klusterhantering
- Övervaka Spark-program och klusterresurser
- Säkerhetskonfigurationer och användarhantering
Justering och optimering av prestanda
- Resursallokering och schemaläggning
- Justera Spark för optimal prestanda
- Identifiera och lösa vanliga flaskhalsar
Felsökning och problemlösning
- Vanliga utmaningar med Spark-administration
- Diagnostiska verktyg och tekniker för felsökning
- Steg-för-steg-metod för att lösa vanliga problem
- Metodtips för att upprätthålla en felfri Spark-miljö
Avancerade administrationsämnen
- Integration med andra big data-verktyg
- Säkerställa hög tillgänglighet och haveriberedskap
- Uppgradera och skala Spark-kluster
Sammanfattning och nästa steg
Krav
- Grundläggande kunskaper om nätverkskonfiguration och -hantering
- Kännedom om Linux operativsystem och kommandoradsgränssnitt
- Intresse för att lära sig mer om distribuerade datorsystem och hantering av stora datamängder
Publik
- Systemadministratörer
Vittnesmål (3)
En resa genom Spark-världen: ett mycket intensivt kursmoment. DSL, Spark SQL, partitionering kontra bucketing för mig.
Georgiana Elisabeta
Kurs - Apache Spark Fundamentals
Maskintolkat
Jag tyckte att det var praktiskt. Älskade att tillämpa den teoretiska kunskapen med praktiska exempel.
Aurelia-Adriana - Allianz Services Romania
Kurs - Python and Spark for Big Data (PySpark)
Maskintolkat
Det faktum att vi kunde ta med oss den mesta av informationen/kursen/presentationerna/övningarna som gjordes, så att vi kan gå igenom dem och eventuellt göra om det vi inte förstod första gången eller förbättra det vi redan har gjort.
Raul Mihail Rat - Accenture Industrial SS
Kurs - Python, Spark, and Hadoop for Big Data
Maskintolkat