Pomiń do treści
Logo firmy PKO BP Finat

Data Engineer ze znajomością przetwarzania danych niestrukturalnych

PKO BP Finat

Oferta w skrócie
Widełki nieujawnione
🔀HybrydowaTryb pracy
📄B2BKontrakt
⏱️Mid · 3+ latDoświadczenie
LokalizacjaWarszawa
Źródło
Aktywna
Opublikowano15 czerwca 2026
Ostatnio sprawdzono15 czerwca 2026
Wygasa za50 dni
Werdykt JobHunt

Rola w wewnętrznym zespole banku PKO BP, zajmującym się budową i utrzymaniem Data Lake. Głównym wyzwaniem jest przetwarzanie danych niestrukturalnych (audio, obrazy, dokumenty tekstowe) z wykorzystaniem technologii strumieniowych (Kafka/Pub/Sub) i chmury GCP (BigQuery, Data Proc, Data Flow). To typowa rola Data Engineera zorientowana na integrację danych, przetwarzanie strumieniowe i optymalizację baz danych. Bankowość zapewnia stabilność, ale może wiązać się z legacy systemami.

Brak jawnych widełek — wynagrodzenie do ustalenia podczas rekrutacji.

Brakuje: nie podano wielkości zespołu, brak opisu procesu rekrutacyjnego.

🛠 Wymagane technologie
Dane źródłowe
Data LakePythonKafka
AI Insights
Czym naprawdę jest ta rola?Data Engineer

Rola w wewnętrznym zespole banku PKO BP, zajmującym się budową i utrzymaniem Data Lake. Głównym wyzwaniem jest przetwarzanie danych niestrukturalnych (audio, obrazy, dokumenty tekstowe) z wykorzystaniem technologii strumieniowych (Kafka/Pub/Sub) i chmury GCP (BigQuery, Data Proc, Data Flow). To typowa rola Data Engineera zorientowana na integrację danych, przetwarzanie strumieniowe i optymalizację baz danych. Bankowość zapewnia stabilność, ale może wiązać się z legacy systemami.

Plusy
  • Praca w stabilnym, dużym banku PKO BP
  • Ciekawy obszar przetwarzania danych niestrukturalnych z wykorzystaniem GenAI
  • Elastyczność w ustaleniu trybu hybrydowego/zdalnego
Na co uważać
  • !Model hybrydowy z 'do ustalenia' – niejasna częstotliwość wizyt w biurze
  • !Wąski zakres wymagań – dużo technologii, ale brak informacji o skali systemu i wielkości zespołu
  • !Nieokreślony proces rekrutacyjny
  • ?Brak jawnych widełek — wynagrodzenie do ustalenia podczas rekrutacji
Codzienna praca
  • Projektowanie i budowa rozwiązań Data Lake na GCP
  • Tworzenie pipeline'ów do przetwarzania danych niestrukturalnych (audio, obrazy, dokumenty)
  • Implementacja architektury sterowanej zdarzeniami z użyciem Kafki lub Pub/Sub
  • Optymalizacja i tuning zapytań w GCP BigQuery, Oracle, PostgreSQL
  • Programowanie w Pythonie i/lub Ruście do automatyzacji i przetwarzania danych
  • Integracja zewnętrznych narzędzi ETL (Informatica, Automate Now) i orkiestracja w Airflow
  • Współpraca przy wykorzystaniu GenAI do przetwarzania danych niestrukturalnych (np. transkrypcje, OCR)
  • Praca w systemie Linux na poziomie zaawansowanego użytkownika
Więcej o ofercie
Dla kogo jest ta oferta
Profil idealny

Oferta skierowana do developerów z doświadczeniem komercyjnym (Mid).

Minimum sensowne

Tester/QA lub administrator baz danych z 2-3 latami doświadczenia, który zna SQL i Linux, i jest w stanie szybko nauczyć się Pythona i data engineeringu na GCP.

Raczej nie dla

Osoby szukające w pełni zdalnej pracy lub oczekujące wyłącznie pracy z nowoczesnym stackiem bez elementów legacy (Oracle, Informatica). Juniorzy bez doświadczenia w Data Lake i przetwarzaniu strumieniowym nie spełnią wymagań.

Ocena dopasowania
Junior1/5
Mid4/5
Senior3/5
Hands-on4/5
Architekt2/5
Remote3/5
Enterprise4/5
Pytania do rekrutera
  • ?Ile osób liczy zespół Data Engineering i ile osób pracuje nad danymi niestrukturalnymi?
  • ?Jakie konkretnie przypadki użycia GenAI są planowane (np. OCR, transkrypcje, analiza obrazów)?
  • ?Czy istnieje już infrastruktura GCP, czy będzie budowana od podstaw?
  • ?Jaki jest zakres odpowiedzialności za legacy systemy (Oracle, Informatica)?
  • ?Czy przewidziane są dyżury on-call lub praca w godzinach nadliczbowych?
  • ?Jak wygląda proces rekrutacyjny – ile etapów, czy jest zadanie techniczne?
  • ?Czy firma oferuje budżet szkoleniowy na certyfikacje GCP?
Brakujące informacje
  • Nie podano wielkości zespołu
  • Brak opisu procesu rekrutacyjnego
  • Nie wiadomo, czy praca dotyczy konkretnego projektu czy wsparcia wielu zespołów
  • Brak informacji o on-call lub dyżurach
Zespół

Prawdopodobnie dojrzały zespół IT w banku, z naciskiem na stabilność i jakość, ale z otwartością na nowe technologie (GenAI).

🔗Podobne oferty