Tack för att du skickade din fråga! En av våra teammedlemmar kontaktar dig snart.
Tack för att du skickade din bokning! En av våra teammedlemmar kontaktar dig snart.
Kursplan
Introduktion:
- Apache Spark i Hadoop-ekosystemet
- Kort introduktion till python och scala
Basgrunder (teori):
- Aarkitektur
- RDD
- Transformationer och åtgärder
- Stage, Task, beroenden
Att använda Databricks-miljön för att förstå grunderna (praktisk workshop):
- Övningar med RDD-API
- Grundläggande åtgärds- och transformationsfunktioner
- PairRDD
- Join
- Cache-strategier
- Övningar med DataFrame-API
- SparkSQL
- DataFrame: select, filter, group, sort
- UDF (User Defined Function)
- Tittar på DataSet-API
- Streaming
Att använda AWS-miljön för att förstå implementation (praktisk workshop):
- Basgrunder för AWS Glue
- Förstå skillnaderna mellan AWS EMR och AWS Glue
- Exempeljobb i båda miljöerna
- Förstå för- och nackdelar
Extra:
- Introduktion till Apache Airflow-orchestrering
Krav
Programmeringskunskaper (föredraget python, scala)
SQL-grunder
21 Timmar
Vittnesmål (3)
Att ha praktiska sessioner/uppdrag
Poornima Chenthamarakshan - Intelligent Medical Objects
Kurs - Apache Spark in the Cloud
Maskintolkat
1. Rätt balans mellan högnivåkoncept och tekniska detaljer. 2. Andras är mycket kunskapsgivare i sin undervisning. 3. Övnings
Steven Wu - Intelligent Medical Objects
Kurs - Apache Spark in the Cloud
Maskintolkat
Få lära dig Spark Streaming, Databricks och AWS Redshift
Lim Meng Tee - Jobstreet.com Shared Services Sdn. Bhd.
Kurs - Apache Spark in the Cloud
Maskintolkat