Przejdź do treści

Szczegóły

🟢 Obowiązkowa rejestracja i zakup biletów:
https://stacja.it/produkt/inzynieria-danych-w-praktyce-od-milionow-rekordow-veturilo-do-biznesowych-wnioskow-w-duckdb-i-pythonie/

🟢 Warsztat weekendowy w godz. 17:00-21:00 (4 h) 🟢

🟢 Czego się nauczysz?
W trakcie webinaru omówimy, jak sprawnie pobierać, składować i przekształcać dane z systemu rowerów miejskich (ponad 200 mln rekordów) – bez chmury i bez drogich narzędzi. Zaprezentowana zostanie architektura Medallion (Bronze/Silver/Gold), budowa potoku ingestion w Pythonie, transformacje SQL z użyciem funkcji okienkowych oraz analiza biznesowa i wizualizacja wyników w Streamlit i Power BI. Wszystko działa lokalnie, na Twoim laptopie.

🟢 Dla kogo warsztat?
Webinar jest dedykowany dla osób na poziomie Junior/Mid, które znają podstawy SQL i Pythona oraz chcą dowiedzieć się, jak realnie pracować z dużymi zbiorami danych bez uciekania się do kosztownych rozwiązań chmurowych.

🟢 Wymagania wstępne
- Podstawowa znajomość SQL i Pythona,
- Zainstalowany Python 3.10+ i DuckDB na lokalnej maszynie.

🟢 Prowadzący
Łukasz Prokulski:
Analityk systemowy IT i architekt rozwiązań danych. Od lat specjalizuje się w inżynierii przepływów danych, projektowaniu architektury oraz budowie systemów Big Data w sektorzee ubezpieczeń. Skutecznie łączy świat biznesu z technologią, doradzając i zbierając wymagania aby przełożyć je na materiał dla zespołów deweloperskich. Posiada szerokie, interdyscyplinarne doświadczenie – w przeszłości m.in. zarządzał projektami jako szef PMO, tworzył narzędzia raportowe dla kadry zarządzającej w spółkach giełdowych, a karierę zaczynał jako UX designer (Gazeta.pl, sektor bankowy).
Pionier edukacji analitycznej w Polsce: twórca pierwszego w kraju bloga (2017) i newslettera (2018) o analizie danych. Aktywnie dzieli się wiedzą jako szkoleniowiec (Python, praca z danymi) oraz autor e-booków i praktycznych projektów, wspierających rozwój kompetencji analitycznych na różnych etapach kariery.

🟢 Program warsztatu
– Rozgrzewka & Live Demo: 200M rekordów czytanych w ułamkach sekund: 30 minut.
– Ingestion & Storage: Python, Parquet i problem małych plików: 45 minut.
– Transformacje SQL: warstwy Silver i rekonstrukcja podróży konkretnego roweru: 60 minut.
– Analiza biznesowa: Streamlit / Power BI i przykładowe case study: 60 minut.
– Q&A: 15-30 minut.

UWAGA
Liczba miejsc ograniczona! Organizator zastrzega sobie prawo do odwołania wydarzenia w przypadku niezgłoszenia się minimalnej liczby uczestników.

🟢 Obowiązkowa rejestracja i zakup biletów:
https://stacja.it/produkt/inzynieria-danych-w-praktyce-od-milionow-rekordow-veturilo-do-biznesowych-wnioskow-w-duckdb-i-pythonie/

Pokrewne tematy

Data Analytics
Data Mining
Data Science

Może ci się również spodobać