Tokyo · Permanent · Senior (6-9 ans)
Senior Data Engineer — Banque digitale (Tokyo)
Une nouvelle banque digitale à Tokyo recrute un Senior Data Engineer pour construire son hub de données central sur Databricks/Delta Lake. Résidence au Japon obligatoire, japonais niveau business requis.
- AWS
- Databricks
- Delta Lake
- Unity Catalog
- Apache Spark
- Terraform
Conditions du poste
Résidence au Japon obligatoire — le poste ne prévoit ni relocation ni sponsoring de visa. Les candidatures depuis l'étranger ne pourront pas être traitées.
Japonais niveau business requis.
Contexte
Notre client construit une nouvelle banque digitale à Tokyo, née d'une joint-venture entre un acteur majeur de la fintech japonaise et un groupe bancaire de premier plan. L'ambition : construire des produits financiers embarqués pensés dès l'origine pour les petites et moyennes entreprises (PME).
Le poste
En tant que Senior Data Engineer au sein de l'équipe Data Platform, vous construisez et maintenez le hub de données central qui connecte la quasi-totalité des systèmes de cette nouvelle banque digitale. Vous alimentez en données les systèmes bancaires, appliquez la logique métier nécessaire, puis servez ces données aux systèmes avals de pilotage, de reporting réglementaire et de gestion des risques. Poste senior en contribution individuelle : vous concevez et implémentez des pipelines de données complexes, mentorez des ingénieurs confirmés et participez aux décisions d'architecture de la plateforme.
Équipe
Petite équipe agile de 11 ingénieurs, en collaboration étroite avec les équipes métier bancaires.
Stack technique
- Cloud — AWS (région Tokyo), S3 data lake, VPC, IAM
- Lakehouse Databricks — Delta Lake (ACID, time-travel, schema evolution), architecture médaillon Bronze/Silver/Gold, Unity Catalog
- Orchestration & traitement — Databricks Workflows, Apache Spark, ingestion batch et streaming avec AutoLoader
- Transformation — Delta Live Tables, SQL et Python, matérialisation incrémentale
- Analytics — Databricks SQL, entrepôts SQL auto-scalables, API REST de mise à disposition des données
- Dev & DevOps — SQL, Python, GitHub, GitHub Actions, Terraform, outils IA (Claude Code, GitHub Copilot)
Missions
- Concevoir et implémenter des pipelines de données ingérant plusieurs systèmes sources via API REST ou connexions base de données
- Construire et maintenir les transformations Bronze/Silver/Gold en garantissant qualité, cohérence et performance des données
- Implémenter des contrôles de qualité et une logique de réconciliation inter-systèmes
- Développer et optimiser des requêtes et transformations SQL via Databricks SQL/notebooks ou Delta Live Tables
- Concevoir des modèles de données pour l'analytics et le reporting, avec un focus sur l'intégration des données CRM ainsi que le reporting réglementaire et les exports vers les systèmes avals de gestion des risques
- Construire des API REST ou des couches de mise à disposition de données pour les consommateurs avals
- Participer aux décisions d'architecture de la plateforme data
- Écrire des tests unitaires, d'intégration et de qualité des données
- Superviser la performance des pipelines, diagnostiquer les incidents, implémenter des améliorations
- Optimiser la performance des requêtes (partitionnement, Z-ordering, tuning)
- Implémenter l'infrastructure as code avec Terraform
- Mettre en place le CI/CD pour les tests et déploiements automatisés
- Mentorer des ingénieurs confirmés, réaliser des revues de code
Profil recherché
- Résidant déjà au Japon avec une autorisation de travail valide — pas de relocation ni de sponsoring de visa depuis l'étranger pour ce poste
- Japonais niveau business requis
- 5 ans et plus d'expérience en data engineering ou analytics engineering
- Solide maîtrise de SQL et Python
- Expérience concrète de construction de pipelines de données avec des outils modernes (Databricks, Spark ou équivalent)
- Expérience des plateformes data cloud (AWS, Azure, GCP) et du stockage associé (S3, ADLS, GCS)
- Solide modélisation de données : dimensionnelle, data vault ou architectures événementielles
- Expérience de la validation et des tests de qualité de données
- Capacité avérée à déboguer et optimiser des requêtes et traitements lents
- Git et pipelines CI/CD
- Notions de gouvernance des données : contrôle d'accès, audit, lignage
- Autonomie et solide capacité de résolution de problèmes
- Expérience de mentorat d'ingénieurs juniors ou confirmés
- Bac+5 en informatique, ingénierie ou équivalent, ou expérience pratique équivalente
Atouts
Anglais niveau business (TOEIC 700+) · expérience finance / fintech / secteurs régulés · domaine bancaire (core banking, paiements, reporting réglementaire, AML) · plateformes data conformes (FISC, FSA/BOJ, GDPR, APPI) · Databricks (AutoLoader, Unity Catalog, DLT, Databricks SQL, Workflows) · réconciliation inter-systèmes sur données financières · tuning de performance et gestion des coûts Databricks · API REST en Python (FastAPI, Flask) · ingestion streaming (Kafka, Kinesis) · contributions open source.
Postuler
Senior Data Engineer — Banque digitale (Tokyo)
