Szkolenie dla firm

Apache Spark - projektowanie i rozwój aplikacji Big Data

Przygotowanie uczestników do samodzielnej pracy z Apache Spark oraz zrozumienia mechanizmów przetwarzania rozproszonego.

Dla kogo

  • Data Engineerów
  • programistów pracujących z danymi
  • Data Scientistów
  • architektów danych
  • zespołów rozpoczynających pracę z Apache Spark

Typowy zakres

  • architektura Apache Spark
  • Spark Core, RDD i DataFrame API
  • Spark SQL
  • partycjonowanie danych i Shuffle
  • Budowa joba/aplikacji sparkowej
  • Logika: joiny, grupowanie, funkcje sparkowe, UDFy
  • Monitoring aplikacji sparkowej

Technologie

  • Apache Spark
  • PySpark
  • Spark SQL
  • DataFrame API

Organizacja szkolenia

  • online lub w siedzibie klienta
  • zwykle 1-3 dni
  • rekomendowane grupy do 10 uczestników
  • teoria przeplatana laboratoriami praktycznymi
  • materiały szkoleniowe i certyfikat po zakończeniu

Standard realizacji szkoleń

Zrozumienie i praktyka

Łączymy wyjaśnienie mechanizmów technologii z laboratoriami, w których uczestnicy pracują samodzielnie.

Środowisko szkoleniowe

Przygotowujemy środowisko przed zajęciami, aby uczestnicy od początku pracowali w warunkach zbliżonych do projektowych.

Program dopasowany do organizacji

Przed szkoleniem ustalamy poziom grupy, cele, technologie i oczekiwane rezultaty.

Najczęściej zadawane pytania

Czy szkolenie Apache Spark jest przeznaczone dla firm?

Tak. Szkolenie prowadzimy dla zespołów firmowych i dopasowujemy zakres do doświadczenia uczestników oraz technologii używanych w organizacji.

Czy uczestnicy pracują na praktycznych ćwiczeniach?

Tak. Teoria jest łączona z laboratoriami i zadaniami wykonywanymi w przygotowanym środowisku szkoleniowym.

Czy można zmienić zakres szkolenia?

Tak. Szczegółowy program ustalamy przed szkoleniem, po rozmowie o poziomie zespołu, projekcie i oczekiwanych rezultatach.

Czy uczestnicy muszą umieć cokolwiek ze Sparka na początku?

Nie, szkolenie jest całkowicie od podstaw. Uczymy się od najbardziej podstawowego pytania czyli "Co to jest Spark?"

Czy szkolenie jest czysto narzędziowe, czy dotyka koncepcji przetwarzania rozproszonego?

Dojrzały inżynier danych zna przede wszystkim koncepcję, a narzędzie dopiero jako implementację koncepcji. I tak też podchodzimy do szkolenia. Uczestnicy będą rozumieli na czym polega przetwarzanie rozproszone oraz Apache Spark jako techniczne narzędzie, które realizuje tę koncepcję.

Opinie klientów

Referencje od osób i organizacji, które korzystały ze szkoleń oraz programów Akademii Big Data.

Kontakt

Porozmawiajmy o potrzebach Twojego zespołu

Opisz krótko sytuację organizacji, technologie i cel rozmowy. Wszystkie formularze w sekcji prowadzą do jednego procesu kontaktowego.