About this role
Over de Rol Bij Lemon geloven we dat de beste oplossingen voortvloeien uit diverse perspectieven. Ben jij de Data Engineer die energie krijgt van het bouwen en onderhouden van robuuste, schaalbare data-pipelines? Binnen ons Data-team zoeken we een technisch kompas om data te integreren vanuit diverse bronnen en deze feilloos te transformeren in een modern data lakehouse. Of je nu zweert bij Azure of AWS, en of je hart nu sneller klopt van Databricks of Snowflake: jouw doel is het leveren van betrouwbare, kwalitatieve data die klaar is voor analytics en AI. Je krijgt bij ons de ruimte om te pionieren met een moderne data stack, hybride cloud-omgevingen en multi-cloud strategieën. Je werkt autonoom en neemt ownership over je pipelines, maar altijd als deel van een hecht, cross-functioneel team. Jouw bijdrage Wij zoeken een tech-enthousiasteling die een proactieve rol wil spelen: Ontwerpen, bouwen en optimaliseren van betrouwbare data-pipelines (bijvoorbeeld met PySpark, Delta Lake en de Medallion Architectuur). Integreren en structureren van data in cloud-omgevingen, waarbij je de brug slaat tussen ruwe data en bruikbare business inzichten. Werken met geavanceerde SQL- en Python-oplossingen om data-flows soepel en performant te laten verlopen. Meedenken over en bijdragen aan Infrastructure as Code (zoals Terraform) om onze data-infrastructuur slim te deployen. Actief kennis delen tijdens lunch & learns en collegiale feedback geven via peer reviews of code reviews. Bijdragen aan de continue verbetering van de data-architectuur en engineering-methodologieën binnen Lemon. Welke kwaliteiten breng je mee? Gericht op competenties en potentieel, moedigen we je aan om te solliciteren als je denkt dat je over de juiste basis beschikt. We zoeken geen schaap met vijf poten, wel een gedreven professional met een passie voor data engineering en een gezonde dosis leergierigheid. Essentiële Vaardigheden & Ervaring Python & SQL: Je bent sterk in Python (voor data pipelines) en beschikt over een gevorderde kennis van SQL (denk aan window functions, CTEs en performance tuning). Databricks & Spark óf Snowflake: Je hebt praktische ervaring met een modern data platform. Dit kan Databricks zijn (PySpark, cluster-beheer, jobs optimalisatie) óf een data warehousing platform zoals Snowflake (architectuur, data sharing) of Azure Synapse. Kennis van Kimball is een plus! Cloud Platforms (Azure óf AWS): Je voelt je comfortabel in de cloud. Je hebt praktijkervaring met Azure (bv. Data Factory, Blob Storage, Key Vault) én/of AWS (bv. S3, Glue, Lambda, IAM). Kennis van Microsoft Fabric is ook super. Infrastructure as Code: Je hebt ten minste een basisbegrip of gemiddelde kennis van tools zoals Terraform voor het deployen van infrastructuur. Communicatie: Je kunt je vlot uitdrukken in zowel het Nederlands als het Engels voor een vlotte zakelijke communicatie. Nice-to-have (Pluspunten – zéker geen harde eisen!) Ervaring met Streaming (Apache Kafka, Event Hubs, Spark Structured Streaming) voor real-time data. Kennis van Orchestration & CI/CD (Airflow, Azure Data Factory pipelines, GitHub Actions, Azure DevOps of GitLab CI). Feeling met Data Governance (Unity Catalog of Snowflake governance features) of Frontend tools (zoals PowerBI). Certificeringen zijn een absolute kers op de taart, zoals: Databricks Certified Data Engineer Professional Azure Data Engineer Associate (DP-203) AWS Certified Data Analytics Snowflake SnowPro Core/Advanced Aanbevolen achtergrond Doorgaans een aantal jaren (4 - 6 jaar) relevante ervaring als Data of BI Engineer, bij voorkeur op Medior of Senior niveau. Een academische achtergrond (Bachelor/Master) in een IT- of kwantitatieve richting is mooi, maar jouw aantoonbare skills en tech-driven mindset zijn voor ons het allerbelangrijkst!