Kursplan
Introduksjon til Apache Spark
- Rollen til Spark i stordatabehandling
- Gnistarkitektur og dens komponenter
Oppsett Apache Spark
- Krav til maskinvare og programvare
- Installasjonsprosedyrer for frittstående og klyngemoduser
- Beste praksis for konfigurasjon for systemadministratorer
Administrering av gnistklynger
- Klyngehåndteringsverktøy og teknikker
- Overvåking av Spark-applikasjoner og klyngeressurser
- Sikkerhetskonfigurasjoner og brukeradministrasjon
Ytelsesjustering og optimering
- Ressursfordeling og planlegging
- Tuning Spark for optimal ytelse
- Identifisere og løse vanlige flaskehalser
Feilsøking og problemløsning
- Vanlige Spark-administrasjonsutfordringer
- Diagnostiske verktøy og teknikker for feilsøking
- Trinn-for-trinn tilnærming til å løse vanlige problemer
- Beste praksis for å opprettholde et sunt Spark-miljø
Avanserte administrasjonsemner
- Integrasjon med andre store dataverktøy
- Sikre høy tilgjengelighet og katastrofegjenoppretting
- Oppgradering og skalering av Spark-klynger
Sammendrag og neste trinn
Krav
- Grunnleggende kunnskap om nettverkskonfigurasjon og -administrasjon
- Kjennskap til Linux operativsystem og kommandolinjegrensesnitt
- Interesse for å lære om distribuerte datasystemer og big data management
Publikum
- Systemadministratorer
Referanser (3)
En reise gjennom Spark-verdenen: et svært intensivt kurs. DSL, Spark SQL, partisjonering kontra bucketing for meg.
Georgiana Elisabeta
Kurs - Apache Spark Fundamentals
Maskinoversatt
Jeg likte at det var praktisk. Elsket å anvende den teoretiske kunnskapen med praktiske eksempler.
Aurelia-Adriana - Allianz Services Romania
Kurs - Python and Spark for Big Data (PySpark)
Maskinoversatt
Det er en fordel at vi kunne medføre mest av informasjonen/kursmaterialet/presentasjonene/øvingene med oss, slik at vi kan se gjennom dem og kanskje gjøre om det vi ikke forsto første gang eller forbedre det vi allerede har gjort.
Raul Mihail Rat - Accenture Industrial SS
Kurs - Python, Spark, and Hadoop for Big Data
Maskinoversatt