↳Tu te distingues par plusieurs années d-expérience dans le développement de pipelines de données productifs avec Scala (2.12) et Apache-Spark (3.x); tu connais les bonnes pratiques pour des applications performantes et permettant de réaliser des tests et des maintenances avec Scalatest, Scalafmt et ScalaFix.
↳Des connaissances approfondies de SQL et d-Apache Iceberg te permettent de gérer en toute sécurité les transactions ACID, les formats de table et l-évolution du schéma dans des architectures data-lakehouse modernes.
↳Dans l-environnement AWS, tu disposes d-une expérience pratique avec au moins trois services de données pertinents tels qu-AWS Glue, Amazon-EMR-Serverless, Amazon-Athena, AWS-Lambda, AWS-Step-Functions, Amazon-S3 ou AWS-Lake-Formation.
↳Tu décris et gères les infrastructures cloud avec Terraform (à partir de la version-1.2) et tu possèdes une bonne compréhension de l-ensemble du cycle de vie de l-infrastructure en tant que code.
↳Idéalement, tu as déjà pu acquérir de l-expérience avec Apache-Kafka, OpenLineage, AWS Lake-Formation ou des solutions modernes de monitoring et de reporting comme Grafana, Amazon-QuickSight ou Power-BI.
↳Tu as plaisir à collaborer avec des équipes interdisciplinaires, tu es capable de travailler en autonomie et de transmettre des faits techniques de manière compréhensible.
↳Tu communiques avec aisance en français ou en allemand; tu as de bonnes connaissances de l-anglais technique.