Trwają zapisy do grupy

Szkolenie: Apache Spark – Structured Streaming

Szkolenie Apache Spark Structured Streaming to praktyczny kurs projektowania i wdrażania aplikacji do przetwarzania strumieni danych w czasie rzeczywistym z użyciem PySpark, Apache Kafka i Delta Lake, obejmujący mikrobatch, event-time, watermark, okna czasowe, checkpointing, exactly-once, monitoring, odporność na awarie oraz optymalizację wydajności rozwiązań produkcyjnych

  • Trenerzy praktycy
  • Kameralne grupy

Czas trwania szkolenia:2 dni (16h)

Poziom zaawansowania:

Kod kursu:BIGDATA/SPARKSS

apache-kafkapyspark

Dostępne terminy szkolenia

  • Termin
  • Trener
  • Cena
  • Lokalizacja
  • Zapis

Termin:

30 listopada - 1 grudnia
Trwają zapisy na szkolenieTrwają zapisy na szkolenie
Dostępne w Bazie Usług RozwojowychDostępne w Bazie Usług Rozwojowych
online_paymentsonline_payments

Trener:

Krzysztof Jankiewicz

Cena:

2450 PLN netto
Dowiedz się więcej o cenach szkoleń - zapraszamy do kontaktuDowiedz się więcej o cenach szkoleń - zapraszamy do kontaktu
+23% VAT

Lokalizacja:

Zdalne
Zdalne
Zapytaj o inne lokalizacje - w tym celu skorzystaj z chatuZapytaj o inne lokalizacje - w tym celu skorzystaj z chatu

Termin:

17 grudnia - 18 grudnia
Trwają zapisy na szkolenieTrwają zapisy na szkolenie
Dostępne w Bazie Usług RozwojowychDostępne w Bazie Usług Rozwojowych
online_paymentsonline_payments

Trener:

Trener-Sages

Cena:

2450 PLN netto
Dowiedz się więcej o cenach szkoleń - zapraszamy do kontaktuDowiedz się więcej o cenach szkoleń - zapraszamy do kontaktu
+23% VAT

Lokalizacja:

Zdalne
Zdalne
Zapytaj o inne lokalizacje - w tym celu skorzystaj z chatuZapytaj o inne lokalizacje - w tym celu skorzystaj z chatu

Forma szkolenia

Interesuje Cię szkolenie stacjonarne?

Powiadom o kolejnych terminach

Interesuje Cię szkolenie w innym terminie?

Apache Spark – Structured Streaming

Cele szkolenia

  • Szkolenie przygotowuje do samodzielnego projektowania i uruchamiania aplikacji strumieniowych w Apache Spark Structured Streaming z użyciem PySpark, Apache Kafka oraz narzędzi wdrożeniowych stosowanych w środowisku produkcyjnym

  • Szkolenie uczy budowania potoków danych czasu rzeczywistego z integracją źródeł i ujść, w tym Apache Kafka, Delta Lake oraz relacyjnych baz danych z wykorzystaniem właściwych trybów zapisu i mechanizmów Structured Streaming

  • Szkolenie pokazuje, jak konfigurować event-time, watermark, okna czasowe, triggery i partycje shuffle oraz jak dobierać parametry przetwarzania danych do charakterystyki strumienia i wymagań biznesowych

  • Szkolenie przygotowuje do monitorowania zapytań strumieniowych, analizowania metryk, diagnozowania opóźnień danych, problemów ze stanem aplikacji oraz optymalizacji wydajności mikro-wsadów w Apache Spark

  • Szkolenie omawia zasady budowania niezawodnych aplikacji 24/7 z użyciem checkpointów, mechanizmów odtwarzania po awarii, zarządzania stanem oraz semantyki dostarczania danych exactly-once

  • Szkolenie rozwija umiejętność świadomego doboru ujść, strategii zapisu, sposobu obsługi danych opóźnionych oraz metod optymalizacji wydajności w celu utrzymania spójności, skalowalności i wysokiej dostępności rozwiązania


Dla kogo?

  • Inżynierowie danych rozwijający lub utrzymujący potoki danych czasu rzeczywistego w środowiskach Spark i Kafka

  • Programiści Python lub PySpark z doświadczeniem w DataFrame API, rozszerzający kompetencje o przetwarzanie strumieniowe

  • Architekci i developerzy projektujący skalowalne aplikacje danych z wymaganiami wysokiej dostępności i spójności

  • Specjaliści Big Data odpowiedzialni za wdrożenia produkcyjne, monitoring, optymalizację i integrację ujść danych


Efekty kształcenia

  • Uczestnik projektuje aplikację strumieniową w Apache Spark Structured Streaming z wykorzystaniem PySpark i dobrych praktyk produkcyjnych

  • Uczestnik konfiguruje źródła i ujścia danych dla przetwarzania danych w czasie rzeczywistym z użyciem Apache Kafka, Delta Lake oraz baz relacyjnych

  • Uczestnik analizuje event-time, watermark i okna czasowe w strumieniu danych oraz dobiera odpowiednią strategię przetwarzania

  • Uczestnik monitoruje metryki zapytań, ocenia stan oraz wydajność aplikacji Structured Streaming i identyfikuje wąskie gardła

  • Uczestnik organizuje checkpointing, odtwarza przetwarzanie po awarii oraz wdraża mechanizmy zapewniające wysoką niezawodność aplikacji

  • Uczestnik optymalizuje partycje, triggery i zapis wyników do ujść produkcyjnych, zwiększając wydajność i skalowalność aplikacji streamingowych


Wymagania

  • Konieczna znajomość języka Python na poziomie umożliwiającym samodzielne pisanie skryptów

  • Konieczna znajomość Spark DataFrame API i Spark SQL (np. w zakresie szkolenia Apache Spark – wprowadzenie)

  • Silnie rekomendowana znajomość podstawowych pojęć Apache Kafka (temat, partycja, offset, producent, konsument)

  • Rekomendowana znajomość relacyjnego modelu danych i podstawowych poleceń SQL

  • Rekomendowana znajomość środowiska Docker na poziomie uruchamiania i zatrzymywania kontenerów


W cenie otrzymasz:

  • Materiały szkoleniowe

  • Certyfikat ukończenia szkolenia

  • W przypadku szkolenia w trybie stacjonarnym zapewnimy Ci również lunch oraz sprzęt niezbędny do nauki

Program szkolenia

Pobierz program w PDF
  • Autorem szkolenia jest Krzysztof Jankiewicz

    Konsultant IT i wykładowca akademicki. Specjalista w zakresie ogólnie rozumianego przetwarzania danych. Począwszy od relacyjnych systemów baz danych, poprzez architekturę, utrzymanie i wykorzystywanie hurtowni danych, bazy danych NoSQL, systemy danych przestrzennych, po narzędzia i platformy Big Data. Od samego początku pracy zawodowej stara się jako konsultant znajdować czas na kontakty przemysłem, gdzie swoją wiedzę może konfrontować i rozwijać w oparciu o rzeczywiste przypadki. Począwszy od…

  • Szkolenie poprowadzi jego autor Krzysztof Jankiewicz

    Konsultant IT i wykładowca akademicki. Specjalista w zakresie ogólnie rozumianego przetwarzania danych. Począwszy od relacyjnych systemów baz danych, poprzez architekturę, utrzymanie i wykorzystywanie hurtowni danych, bazy danych NoSQL, systemy danych przestrzennych, po narzędzia i platformy Big Data. Od samego początku pracy zawodowej stara się jako konsultant znajdować czas na kontakty przemysłem, gdzie swoją wiedzę może konfrontować i rozwijać w oparciu o rzeczywiste przypadki. Począwszy od…

Wybrane opinie

Przeczytaj pozytywne opinie pochodzące z ankiet satysfakcji z naszych szkoleń wypełnianych wyłącznie przez ich uczestników po realizacji usługi

4.8
Ocena pochodzi ze średniej ocen Sages w serwisie Google i nie jest weryfikowanaŚrednia ocen Sages w serwisie Google Ocena pochodzi ze średniej ocen Sages w serwisie Google i nie jest weryfikowana
  • 13.09.2026

    Natalia Jary, SII sp. z o.o.

    Bardzo doceniam dostosowanie przebiegu szkolenia do stopnia zaawansowania grupy i dostosowania się w miarę możliwości do każdego :)

  • 13.09.2026

    Grzegorz Trzeciak, SII sp. z o.o.

    Oceniam szkolenie jako rewelacyjne, bo celnie trafiało w sedno codziennych problemów i było wypełnione praktycznymi wskazówkami, które mogę od razu wykorzystać. Dwudniowa forma dała czas na przećwiczenie materiału, a nie tylko jego wysłuchanie.

  • 13.09.2026

    Szymon Rutkowski, SII sp. z o.o.

    Czas szkolenia był wykorzystany do maksimum ze świetnie dopasowanym materiałem mimo że poziom i potrzeby uczestników były mocno zróżnicowane. Dzięki!

  • 13.09.2026

    Janusz Rogowski, SII sp. z o.o.

    Indywidualne podejście, rozmowa o live przykładach, dostosowanie, modyfikowanie przebiegu szkolenia żeby dopasować się jak najlepiej do uczestników

  • 13.09.2026

    Małgorzata Ignaczak, SII sp. z o.o.

    Jako osoba początkująca, z tego szkolenia wyciągnęłam dla siebie ogromną dawkę wiedzy. Całe spotkanie mocno zainspirowało mnie do dalszego poszerzania wiedzy w obszarze AI

  • 11.09.2026

    Uczestnik szkoleniaNowoczesna Java

    Piotr Szczypior, Capgemini Polska Sp. z o.o.

    Examples were very interesting

  • 9.09.2026

    Uczestnik szkoleniaAI - Powered Development z Claude Code i GitHub Copilot

    Paweł Wieczorek

    Dużo nowych dla mnie informacji

Więcej opinii

Podobne szkolenia