remotely.living

Cloud Data Engineer (f/m/x)

Sii Poland · Remote - Poland · 2026-09-11

Apply for this job

Job description

Do you want to develop your skills in cloud technologies? Join our specialized unit focusing on experts in data processing and analysis within the Data & Analytics Competence Center. We also offer development in the areas of Data Science, Big Data, and Machine Learning.

Technologies & tools Must have Python SQL ETL/ELT Apache Spark/PySpark Microsoft Azure Databricks Nice to have Snowflake Apache Kafka Apache Airflow Do you want to develop your skills in cloud technologies? Join our specialized unit focusing on experts in data processing and analysis within the Data & Analytics Competence Center. We also offer development in the areas of Data Science, Big Data, and Machine Learning. Your tasks

- Designing, building, and developing scalable and high-performance data processing platforms in Data Lake / Data Platform architecture

- Creating and maintaining ETL/ELT pipelines for data integration from various sources and processing them in the Azure Databricks environment

- Data modeling and preparing data structures tailored to analytical and business needs

- Implementing solutions for data processing (batch and/or near real-time)

- Monitoring, optimizing, and developing existing pipelines and data processing processes

- Collaborating with data analysts, BI teams, and Data Science on data preparation and sharing

- Gathering business requirements and proposing optimal technological solutions

- Creating and maintaining technical documentation for developed solutions

- Supporting and mentoring less experienced team members, sharing knowledge and best practices

Requirements

- Minimum 4 years of experience in projects related to processing and integrating large volumes of data

- Strong knowledge of SQL and Python

- Experience working with data processing frameworks such as Apache Spark / PySpark

- Practical experience in designing and building Data Lake and Data Warehouse solutions

- Ability to build and maintain ETL/ELT pipelines and work with data orchestration and integration tools

- Commercial experience in cloud-based Microsoft Azure data processing projects (e.g., Databricks, Azure Data Factory, Synapse, Fabric)

- Knowledge of data processing concepts in a distributed environment and optimizing data pipelines

- Ability to communicate fluently in English

- Fluent knowledge of Polish is required

- Required to be located in Poland

Nice to have

- Experience in projects related to data migration from on-premise to cloud (databases: Oracle, PostgreSQL, MS SQL)

Technologie i narzędzia Wymagane Python SQL ETL/ELT Apache Spark/PySpark Microsoft Azure Databricks Mile widziane Snowflake Apache Kafka Apache Airflow Chcesz rozwijać swoje kompetencje w technologiach chmurowych? Dołącz do naszej wyspecjalizowanej jednostki skupiającej ekspertów z dziedziny procesowania i analizy danych w ramach Centrum Kompetencyjnego Data & Analytics. Oferujemy również rozwój w obszarach Data Science, Big Data i Machine Learning. Twoje zadania

- Projektowanie, budowanie i rozwijanie skalowalnych oraz wysokowydajnych platform przetwarzania danych w architekturze Data Lake / Data Platform

- Tworzenie oraz utrzymanie pipeline’ów ETL/ELT do integracji danych z różnych źródeł oraz ich przetwarzania w środowisku Azure Databricks

- Modelowanie danych oraz przygotowywanie struktur danych dostosowanych do potrzeb analitycznych i biznesowych

- Implementacja rozwiązań do przetwarzania danych (batch i/lub near real-time)

- Monitorowanie, optymalizacja i rozwój istniejących pipeline’ów oraz procesów przetwarzania danych

- Współpraca z analitykami danych, zespołami BI oraz Data Science w zakresie przygotowania i udostępniania danych

- Zbieranie wymagań biznesowych oraz proponowanie optymalnych rozwiązań technologicznych

- Tworzenie i utrzymywanie dokumentacji technicznej dla rozwijanych rozwiązań

- Wsparcie oraz mentoring mniej doświadczonych członków zespołu, dzielenie się wiedzą i najlepszymi praktykami

Wymagania

- Minimum 4 lata doświadczenia w projektach związanych z przetwarzaniem i integracją dużych wolumenów danych

- Bardzo dobra znajomość SQL oraz Python

- Doświadczenie w pracy z frameworkami do przetwarzania danych takimi jak Apache Spark / PySpark

- Praktyczne doświadczenie w projektowaniu i budowie rozwiązań Data Lake oraz Data Warehouse

- Umiejętność budowania i utrzymywania pipeline’ów ETL/ELT oraz pracy z narzędziami do orkiestracji i integracji danych

- Komercyjne doświadczenie w projektach opartych o rozwiązania chmurowe Microsoft Azure w obszarze przetwarzania danych (np. Databricks, Azure Data Factory, Synapse, Fabric)

- Znajomość koncepcji przetwarzania danych w środowisku rozproszonym oraz optymalizacji pipeline’ów danych

- Umiejętność swobodnej komunikacji w języku angielskim

- Wymagana płynna znajomość języka polskiego

- Wymagane przebywanie na terenie Polski

Mile widziane

- Doświadczenie w projektach związanych z migracją danych z on-premise do chmury (bazy danych: Oracle, PostgreSQL, MS SQL)