Przejdź do treści
Technologie / Dane i analityka

Spark Streaming z Python i Kafka

Szkolenie poświęcone jest implementacji systemów przetwarzania strumieni danych w czasie rzeczywistym z wykorzystaniem Apache Spark Streaming, Pythona i Apache Kafka. Program prowadzi uczestników przez proces budowy skalowalnych rozwiązań do analizy danych strumieniowych, łącząc teorię z praktycznymi warsztatami implementacyjnymi. Zajęcia skupiają się na rzeczywistych scenariuszach wykorzystania technologii strumieniowych w projektach Big Data.

Dlaczego warto wybrać to szkolenie?

W obliczu ciągłych zmian technologicznych kompetencje techniczne stają się kluczowym atutem na rynku pracy. Szkolenie poświęcone jest implementacji systemów przetwarzania strumieni danych w czasie rzeczywistym z wykorzystaniem Apache Spark Streaming, Pythona i Apache Kafka.

Po ukończeniu szkolenia uczestnicy będą potrafili: Uczestnik zdobędzie praktyczne umiejętności w zakresie implementacji systemów przetwarzania strumieni danych z wykorzystaniem Spark Streaming i Kafka, Nauczy się projektować i wdrażać skalowalne rozwiązania do analizy danych w czasie rzeczywistym, Rozwinie umiejętności w zakresie optymalizacji i monitorowania systemów strumieniowych, Pozna techniki integracji różnych komponentów ekosystemu Big Data. Te kompetencje bezpośrednio przekładają się na wyższą efektywność w realizacji projektów IT.

Szkolenie jest szczególnie wartościowe dla: Inżynierowie danych pracujący z systemami Big Data, Programiści Python zainteresowani przetwarzaniem strumieniowym, Analitycy danych potrzebujący narzędzi do analizy w czasie rzeczywistym.

Co wyróżnia nasze podejście?

EITT łączy wiedzę teoretyczną z intensywnymi warsztatami praktycznymi. W ciągu 1 dnia intensywnego szkolenia uczestnicy pracują na realnych przykładach i scenariuszach, co gwarantuje nie tylko zrozumienie teorii, ale przede wszystkim umiejętność jej praktycznego zastosowania.

Z ponad 2500 szkoleń w ofercie i oceną 4.8/5 od uczestników, EITT jest zaufanym partnerem w rozwoju kompetencji dla organizacji każdej wielkości. Nasi trenerzy to praktycy z wieloletnim doświadczeniem, którzy dzielą się aktualną wiedzą i sprawdzonymi rozwiązaniami.

Szukasz szkolenia dopasowanego do potrzeb Twojego zespołu? Skontaktuj się z nami — przygotujemy program dostosowany do Twoich wymagań.

To szkolenie jest częścią ścieżki:

Korzyści

  • Uczestnik zdobędzie praktyczne umiejętności w zakresie implementacji systemów przetwarzania strumieni danych z wykorzystaniem Spark Streaming i Kafka
  • Nauczy się projektować i wdrażać skalowalne rozwiązania do analizy danych w czasie rzeczywistym
  • Rozwinie umiejętności w zakresie optymalizacji i monitorowania systemów strumieniowych
  • Pozna techniki integracji różnych komponentów ekosystemu Big Data
  • Zdobędzie wiedzę pozwalającą na świadome wybieranie odpowiednich wzorców przetwarzania dla konkretnych przypadków użycia

Dla kogo jest to szkolenie?

Inżynierowie danych pracujący z systemami Big Data
Programiści Python zainteresowani przetwarzaniem strumieniowym
Analitycy danych potrzebujący narzędzi do analizy w czasie rzeczywistym
Architekci rozwiązań Big Data
Deweloperzy aplikacji przetwarzających duże wolumeny danych
Specjaliści ds. integracji systemów Big Data
Data Scientists pracujący z danymi strumieniowymi

Wymagania wstępne

  • Znajomość programowania w języku Python
  • Podstawowa wiedza o Apache Spark
  • Rozumienie koncepcji przetwarzania strumieniowego
  • Doświadczenie w pracy z danymi

Program szkolenia

01

Architektura Spark Structured Streaming

  • Integracja z Apache Kafka
  • Model przetwarzania strumieni
02

Konfiguracja środowiska

  • Implementacja transformacji strumieniowych
  • Operacje na strumieniach danych
03

Agregacje i windowing

  • Łączenie strumieni
  • Obsługa opóźnionych danych
  • Zaawansowane przetwarzanie
04

Watermarking i late data

  • Checkpointing i odporność na awarie
  • Optymalizacja wydajności
  • Monitorowanie przetwarzania
  • Integracja z ekosystemem
05

Sink-i i output modes

  • Integracja z systemami zewnętrznymi
06

Workflow-y strumieniowe

  • Dobre praktyki produkcyjne

Formy realizacji

Online

  • Wygoda uczestnictwa z dowolnego miejsca
  • Interaktywne sesje na żywo z trenerem
  • Materiały dostępne przez 30 dni
  • Brak kosztów dojazdu

Stacjonarnie

  • Bezpośredni kontakt z trenerem i grupą
  • Intensywne warsztaty praktyczne
  • Networking z innymi uczestnikami
  • Pełne skupienie na nauce

Najczęściej zadawane pytania

Jakie są wymagania wstępne do udziału w szkoleniu?

Do udziału w szkoleniu Spark Streaming z Python i Kafka zalecamy: Znajomość programowania w języku Python; Podstawowa wiedza o Apache Spark; Rozumienie koncepcji przetwarzania strumieniowego.

W jakim formacie i jak długo trwa szkolenie?

Szkolenie trwa 1 dzień i jest dostępne w formacie online oraz stacjonarnym. Zajęcia prowadzone są w godzinach 9:00-16:00. Możemy również dopasować harmonogram do potrzeb Twojego zespołu.

Dla kogo przeznaczone jest to szkolenie?

Szkolenie jest skierowane do: Inżynierowie danych pracujący z systemami Big Data; Programiści Python zainteresowani przetwarzaniem strumieniowym; Analitycy danych potrzebujący narzędzi do analizy w czasie rzeczywistym.

Bożena Machowska-Worek
Bożena Machowska-Worek Opiekun szkolenia

Poproś o ofertę

Możliwości dofinansowania

Sprawdź możliwości dofinansowania dla Twojej firmy

Zaufali nam

Szkolimy zespoły największych polskich firm

ING Bank - klient EITT
mBank - klient EITT
PKO Bank Polski - klient EITT
PZU - klient EITT
Allianz - klient EITT
T-Mobile - klient EITT
KGHM - klient EITT
PGE - klient EITT
IKEA - klient EITT
InPost - klient EITT
Leroy Merlin - klient EITT
ZUS - klient EITT

Zainteresowany tym szkoleniem?

Skontaktuj się z nami - przygotujemy ofertę dopasowaną do potrzeb Twojego zespołu.

500+ ekspertów
2500+ szkoleń w ofercie
ISO 9001 certyfikat jakości
Zapytaj o szkolenie
Zadzwoń do nas +48 22 487 84 90