Trwają zapisy do grupy

Szkolenie: Apache Spark – Structured Streaming

Szkolenie Apache Spark Structured Streaming to praktyczny kurs projektowania i wdrażania aplikacji do przetwarzania strumieni danych w czasie rzeczywistym z użyciem PySpark, Apache Kafka i Delta Lake, obejmujący mikrobatch, event-time, watermark, okna czasowe, checkpointing, exactly-once, monitoring, odporność na awarie oraz optymalizację wydajności rozwiązań produkcyjnych

  • Trenerzy praktycy
  • Kameralne grupy

Czas trwania szkolenia:2 dni (16h)

Poziom zaawansowania:

Kod kursu:BIGDATA/SPARKSS

apache-kafkapyspark

Dostępne terminy szkolenia

  • Termin
  • Trener
  • Cena
  • Lokalizacja
  • Zapis

Termin:

6 sierpnia - 7 sierpnia
Trwają zapisy na szkolenieTrwają zapisy na szkolenie
Dostępne w Bazie Usług RozwojowychDostępne w Bazie Usług Rozwojowych

Trener:

Trener-Sages

Cena:

2450 PLN netto
Dowiedz się więcej o cenach szkoleń - zapraszamy do kontaktuDowiedz się więcej o cenach szkoleń - zapraszamy do kontaktu
+23% VAT

Lokalizacja:

Zdalne
Zdalne
Zapytaj o inne lokalizacje - w tym celu skorzystaj z chatuZapytaj o inne lokalizacje - w tym celu skorzystaj z chatu

Termin:

10 września - 11 września
Trwają zapisy na szkolenieTrwają zapisy na szkolenie
Dostępne w Bazie Usług RozwojowychDostępne w Bazie Usług Rozwojowych

Trener:

Trener-Sages

Cena:

2450 PLN netto
Dowiedz się więcej o cenach szkoleń - zapraszamy do kontaktuDowiedz się więcej o cenach szkoleń - zapraszamy do kontaktu
+23% VAT

Lokalizacja:

Zdalne
Zdalne
Zapytaj o inne lokalizacje - w tym celu skorzystaj z chatuZapytaj o inne lokalizacje - w tym celu skorzystaj z chatu

Termin:

22 października - 23 października
Trwają zapisy na szkolenieTrwają zapisy na szkolenie
Dostępne w Bazie Usług RozwojowychDostępne w Bazie Usług Rozwojowych

Trener:

Trener-Sages

Cena:

2450 PLN netto
Dowiedz się więcej o cenach szkoleń - zapraszamy do kontaktuDowiedz się więcej o cenach szkoleń - zapraszamy do kontaktu
+23% VAT

Lokalizacja:

Zdalne
Zdalne
Zapytaj o inne lokalizacje - w tym celu skorzystaj z chatuZapytaj o inne lokalizacje - w tym celu skorzystaj z chatu

Termin:

17 grudnia - 18 grudnia
Trwają zapisy na szkolenieTrwają zapisy na szkolenie
Dostępne w Bazie Usług RozwojowychDostępne w Bazie Usług Rozwojowych

Trener:

Trener-Sages

Cena:

2450 PLN netto
Dowiedz się więcej o cenach szkoleń - zapraszamy do kontaktuDowiedz się więcej o cenach szkoleń - zapraszamy do kontaktu
+23% VAT

Lokalizacja:

Zdalne
Zdalne
Zapytaj o inne lokalizacje - w tym celu skorzystaj z chatuZapytaj o inne lokalizacje - w tym celu skorzystaj z chatu

Forma szkolenia

Interesuje Cię szkolenie stacjonarne?

Powiadom o kolejnych terminach

Interesuje Cię szkolenie w innym terminie?

Apache Spark – Structured Streaming

Cele szkolenia

  • Szkolenie przygotowuje do samodzielnego projektowania i uruchamiania aplikacji strumieniowych w Apache Spark Structured Streaming z użyciem PySpark, Apache Kafka oraz narzędzi wdrożeniowych stosowanych w środowisku produkcyjnym

  • Szkolenie uczy budowania potoków danych czasu rzeczywistego z integracją źródeł i ujść, w tym Apache Kafka, Delta Lake oraz relacyjnych baz danych z wykorzystaniem właściwych trybów zapisu i mechanizmów Structured Streaming

  • Szkolenie pokazuje, jak konfigurować event-time, watermark, okna czasowe, triggery i partycje shuffle oraz jak dobierać parametry przetwarzania danych do charakterystyki strumienia i wymagań biznesowych

  • Szkolenie przygotowuje do monitorowania zapytań strumieniowych, analizowania metryk, diagnozowania opóźnień danych, problemów ze stanem aplikacji oraz optymalizacji wydajności mikro-wsadów w Apache Spark

  • Szkolenie omawia zasady budowania niezawodnych aplikacji 24/7 z użyciem checkpointów, mechanizmów odtwarzania po awarii, zarządzania stanem oraz semantyki dostarczania danych exactly-once

  • Szkolenie rozwija umiejętność świadomego doboru ujść, strategii zapisu, sposobu obsługi danych opóźnionych oraz metod optymalizacji wydajności w celu utrzymania spójności, skalowalności i wysokiej dostępności rozwiązania


Dla kogo?

  • Inżynierowie danych rozwijający lub utrzymujący potoki danych czasu rzeczywistego w środowiskach Spark i Kafka

  • Programiści Python lub PySpark z doświadczeniem w DataFrame API, rozszerzający kompetencje o przetwarzanie strumieniowe

  • Architekci i developerzy projektujący skalowalne aplikacje danych z wymaganiami wysokiej dostępności i spójności

  • Specjaliści Big Data odpowiedzialni za wdrożenia produkcyjne, monitoring, optymalizację i integrację ujść danych


Efekty kształcenia

  • Uczestnik projektuje aplikację strumieniową w Apache Spark Structured Streaming z wykorzystaniem PySpark i dobrych praktyk produkcyjnych

  • Uczestnik konfiguruje źródła i ujścia danych dla przetwarzania danych w czasie rzeczywistym z użyciem Apache Kafka, Delta Lake oraz baz relacyjnych

  • Uczestnik analizuje event-time, watermark i okna czasowe w strumieniu danych oraz dobiera odpowiednią strategię przetwarzania

  • Uczestnik monitoruje metryki zapytań, ocenia stan oraz wydajność aplikacji Structured Streaming i identyfikuje wąskie gardła

  • Uczestnik organizuje checkpointing, odtwarza przetwarzanie po awarii oraz wdraża mechanizmy zapewniające wysoką niezawodność aplikacji

  • Uczestnik optymalizuje partycje, triggery i zapis wyników do ujść produkcyjnych, zwiększając wydajność i skalowalność aplikacji streamingowych


Wymagania

  • Konieczna znajomość języka Python na poziomie umożliwiającym samodzielne pisanie skryptów

  • Konieczna znajomość Spark DataFrame API i Spark SQL (np. w zakresie szkolenia Apache Spark – wprowadzenie)

  • Silnie rekomendowana znajomość podstawowych pojęć Apache Kafka (temat, partycja, offset, producent, konsument)

  • Rekomendowana znajomość relacyjnego modelu danych i podstawowych poleceń SQL

  • Rekomendowana znajomość środowiska Docker na poziomie uruchamiania i zatrzymywania kontenerów


W cenie otrzymasz:

  • Materiały szkoleniowe

  • Certyfikat ukończenia szkolenia

  • W przypadku szkolenia w trybie stacjonarnym zapewnimy Ci również lunch oraz sprzęt niezbędny do nauki

Program szkolenia

Pobierz program w PDF
  • Autorem szkolenia jest Krzysztof Jankiewicz

    Konsultant IT i wykładowca akademicki. Specjalista w zakresie ogólnie rozumianego przetwarzania danych. Począwszy od relacyjnych systemów baz danych, poprzez architekturę, utrzymanie i wykorzystywanie hurtowni danych, bazy danych NoSQL, systemy danych przestrzennych, po narzędzia i platformy Big Data. Od samego początku pracy zawodowej stara się jako konsultant znajdować czas na kontakty przemysłem, gdzie swoją wiedzę może konfrontować i rozwijać w oparciu o rzeczywiste przypadki. Począwszy od…

Wybrane opinie

Przeczytaj pozytywne opinie pochodzące z ankiet satysfakcji z naszych szkoleń wypełnianych wyłącznie przez ich uczestników po realizacji usługi

4.8
Ocena pochodzi ze średniej ocen Sages w serwisie Google i nie jest weryfikowanaŚrednia ocen Sages w serwisie Google Ocena pochodzi ze średniej ocen Sages w serwisie Google i nie jest weryfikowana
  • 24.07.2026

    Uczestnik szkoleniaDocker w praktyce

    Juliusz Drygalski, Capgemini Polska Sp. z o.o.

    Bo było. Bardzo dużo przekazanej wiedzy i dobrze wszystko wytłumaczone. Prowadzący topka

  • 24.07.2026

    Uczestnik szkoleniaArchitektura systemowa i integracja systemów

    Michał Michalczuk

    Ogólnie bardzo dobre, ale bardzo skondensowane i intesywne - zabrakło czasu na więcej praktyki

  • 23.07.2026

    Uczestnik szkoleniaJira - organizacja i zarządzanie projektami

    Agata Lewandowska, Towarowa Giełda Energii S.A.

    Było dostosowane pod konkretny zespół i konkretne tematy.

  • 22.07.2026

    Uczestnik szkoleniaInżynieria wymagań w AI

    Artur Łagosz, Sygnity S.A.

    Usystematyzowało pracę przy tworzeniu wartościowych promptów, pokazało jak działać w pewnym obszarze, konkretnie posługując się notesem w Copilocie

  • 21.07.2026

    Karol Orzechowski, VIOO LABS Polska Sp. z o.o.

    Topic and the trainer were sensational

  • 17.07.2026

    Yevgeniy Wyszyński, Samsung Electronics Polska

    Prowadzący był dobrze przygotowany, materiał odzwierciedlał wszystko co jest potrzebne dla nauki

  • 17.07.2026

    Marcin Matyszkowicz, Samsung Electronics Polska

    Super interaakcja z prowadzącym, na luzie a bardzo merytorycznie

Więcej opinii

Podobne szkolenia