Aller au contenu
M1811 · Collective.work

Data Engineer Hadoop / PySpark - Datalake @ > 3 ans d'XP @ Banque @ Paris - Freelance (H/F)

Description du poste

Taux journalier (TJM): 400-420 € HT selon le profil

Localisation : IDF

Démarrage souhaité : 28/09/2026

Fin prévisionnelle : 26/02/2027

Séniorité : > 3 ans d'expérience

Secteur : Banque / Services financiers

CONTEXTE & ENJEUX

Dans le cadre d'une mission au sein de la DSI d'un grand acteur du secteur bancaire et des services financiers, nous recherchons un Data Engineer Hadoop / PySpark pour intervenir sur le Datalake du CIO Office.

La DSI concernée fournit notamment les applications nécessaires aux activités Technologies & Opérations ainsi qu'aux activités de Banque de Proximité et Assurance.

Le Data Engineer intégrera un environnement Data nécessitant une collaboration étroite avec les équipes de production applicative et DevOps, notamment pour mettre en œuvre les évolutions techniques de la plateforme.

Les principaux enjeux portent sur l'intégration de nouvelles données, leur préparation et leur transformation, ainsi que sur le développement et l'évolution des pipelines de traitement au sein d'un environnement Hadoop.

MISSIONS DÉTAILLÉES

Le consultant aura notamment pour responsabilités de :

Mettre en œuvre de nouvelles ingestions de données au sein du Datalake.

Réaliser les traitements de Data Preparation et de transformation des données.

Développer de nouveaux pipelines de données en PySpark.

Maintenir et faire évoluer les pipelines et traitements Data existants.

Réaliser du Shell Scripting sous Unix/Linux.

Travailler en collaboration avec l'équipe DevOps sur les demandes d'évolution de la plateforme.

Participer au maintien en conditions opérationnelles des traitements Data.

Contribuer aux évolutions techniques de la plateforme en lien avec les équipes de production applicative.

Analyser et résoudre les problématiques techniques rencontrées sur les traitements et flux de données.

Rédiger les spécifications techniques.

Documenter les développements et solutions techniques mis en œuvre.

Participer aux travaux de l'équipe dans un environnement Agile / Scrum.

Collaborer régulièrement avec une partie importante de l'équipe IT basée à Porto, nécessitant une utilisation professionnelle de l'anglais à l'écrit comme à l'oral.

STACK TECHNIQUE

Compétences indispensables :

Hadoop

Python

PySpark

Hive

SQL

Shell Scripting Unix/Linux

Environnement & outils :

Git

Jenkins

Jira

Agile / Scrum

Compétences appréciées / différenciantes :

Indexima

Alteryx

Altair

GCP

BigQuery

Bibliothèques Python orientées API

PROFIL RECHERCHÉ

Nous recherchons un Data Engineer disposant idéalement de 3 à 6 ans d'expérience, avec une très bonne maîtrise de l'écosystème Hadoop / PySpark.

Le profil devra être particulièrement opérationnel sur le développement et le traitement de volumes importants de données, avec une véritable appétence pour les problématiques Data et le développement.

Une très bonne maîtrise de Hadoop, Python/PySpark, Hive, SQL et du Shell Scripting Unix/Linux est indispensable.

Le consultant devra également être capable d'intervenir aussi bien sur la création de nouveaux traitements que sur la maintenance et l'évolution de pipelines existants, dans un environnement impliquant des équipes Data, DevOps et de production applicative.

Les qualités suivantes sont particulièrement attendues :

Autonomie

Dynamisme

Force de proposition

Curiosité technique

Forte capacité d'analyse

Capacité à résoudre des problèmes techniques

Excellent relationnel

Capacité à travailler efficacement en équipe

Aisance dans un environnement international

Un anglais professionnel à l'écrit et à l'oral est indispensable, compte tenu des échanges réguliers avec les équipes IT situées à Porto.

Données marché — Data engineer

Salaire net mensuel
Débutant3 772
Moyen4 501
Expérimenté5 346
Tension du marché

Données non disponibles

Projets de recrutement
21 770

postes prévus (BMO 2025)

Métiers associés

À ne pas manquer

Offres similaires.