Szkolenie dla firm

Apache Spark Structured Streaming - przetwarzanie danych w czasie rzeczywistym

Przygotowanie uczestników do projektowania oraz budowy aplikacji wykorzystujących Apache Spark Structured Streaming.

Dla kogo

  • Data Engineerów
  • programistów rozwijających rozwiązania Big Data
  • zespołów budujących platformy danych
  • organizacji wdrażających przetwarzanie danych w czasie rzeczywistym

Typowy zakres

  • architektura Structured Streaming
  • źródła i odbiorniki danych
  • Windowing
  • State Management
  • Watermarking
  • checkpointy i fault tolerance
  • integracja z Apache Kafka

Technologie

  • Apache Spark Structured Streaming
  • PySpark
  • Spark SQL
  • Apache Kafka (pomocniczo, bez wchodzenia w szczegóły)

Organizacja szkolenia

  • online lub w siedzibie klienta
  • zwykle 1-3 dni
  • rekomendowane grupy do 10 uczestników
  • teoria przeplatana laboratoriami praktycznymi
  • materiały szkoleniowe i certyfikat po zakończeniu

Standard realizacji szkoleń

Zrozumienie i praktyka

Łączymy wyjaśnienie mechanizmów technologii z laboratoriami, w których uczestnicy pracują samodzielnie.

Środowisko szkoleniowe

Przygotowujemy środowisko przed zajęciami, aby uczestnicy od początku pracowali w warunkach zbliżonych do projektowych.

Program dopasowany do organizacji

Przed szkoleniem ustalamy poziom grupy, cele, technologie i oczekiwane rezultaty.

Najczęściej zadawane pytania

Czy szkolenie Apache Spark Structured Streaming jest przeznaczone dla firm?

Tak. Szkolenie prowadzimy dla zespołów firmowych i dopasowujemy zakres do doświadczenia uczestników oraz technologii używanych w organizacji.

Czy uczestnicy pracują na praktycznych ćwiczeniach?

Tak. Teoria jest łączona z laboratoriami i zadaniami wykonywanymi w przygotowanym środowisku szkoleniowym.

Czy można zmienić zakres szkolenia?

Tak. Szczegółowy program ustalamy przed szkoleniem, po rozmowie o poziomie zespołu, projekcie i oczekiwanych rezultatach.

Czy znajomość Sparka jest obowiązkowa?

Tak, uczestnicy muszą znać podstawy Apache Spark. W przypadku braku takiej wiedzy, możemy zrobić szkolenie łączone - Apache Spark + Spark Structured Streaming.

Czy należy znać Kafkę przed rozpoczęciem szkolenia?

Nie, znajomość Kafki nie jest obowiązkowa. Posługujemy się nią jedynie pomocniczo.

Czy szkolenie porusza tematy streamingu, czy traktuje temat jedynie narzędziowo?

Dojrzały inżynier danych zna przede wszystkim koncepcję, a narzędzie dopiero jako implementację koncepcji. I tak też podchodzimy do szkolenia. Uczestnicy będą rozumieli na czym polega przetwarzanie strumieniowe i jak koncepcje te realizowane są przy pomocy Apache Spark.

Opinie klientów

Referencje od osób i organizacji, które korzystały ze szkoleń oraz programów Akademii Big Data.

Kontakt

Porozmawiajmy o potrzebach Twojego zespołu

Opisz krótko sytuację organizacji, technologie i cel rozmowy. Wszystkie formularze w sekcji prowadzą do jednego procesu kontaktowego.