A propos de Bull
Bull c’est une histoire. Un siècle d’innovation Européenne et un environnement de travail où des experts conçoivent des solutions numériques puissantes, durables et souveraines, permettant aux États et aux industries de garder la pleine maîtrise de leurs données et de leur IA.
Bull c’est aussi des milliers d’ingénieurs, de chercheurs, de passionnés de tech, façonnant l’avenir du calcul de haute performance, de l’IA et des technologies quantiques.
Chaque jour, nos équipes repoussent les limites du possible - des architectures HPC de nouvelle génération aux supercalculateurs exascale - soutenues par une R&D de rang mondial, plus de 1 600 brevets et des capacités de bout en bout uniques, couvrant la conception matérielle, l’ingénierie logicielle, la data science et la recherche quantique.
Centrés sur l’humain et portés par l’innovation, où la collaboration s’étend à l’Europe, aux Amériques et à l’Inde, nous partageons cette même vision d’une innovation responsable et durable, avec un impact concret pour nos clients.
_________________________
Contexte
Nous construisons le Bull Enterprise Data Hub, une plateforme de données centralisée qui consolide les données produit de plus de huit systèmes sources (SAP, Salesforce, CQFD, PLM, flux fournisseurs) au sein d'une plateforme unifiée, versionnée et centrée sur les API.
La plateforme alimente :
HPCCAT - le catalogue produit des matériels HPC, IA et quantique (~2 100 composants actifs, ~590 k commandes, 5,2 M lignes de devis)
Tableaux de bord de direction - indicateurs du programme GATE, prévisions S&OP et vues de feuille de route
Intégrations machine à machine - API REST utilisées par CQFD (chiffrage), HPC Designer (jumeau numérique) et des outils externes
Vous rejoindrez une petite équipe de trois personnes à fort impact et serez responsable de la couche data engineering : pipelines d'ingestion, modèles de transformation, qualité des données et infrastructure d'entrepôt.
Stack technique :
Base de données : PostgreSQL 16
Moteur analytique : DuckDB (OLAP, orienté colonnes)
Transformations : dbt-core + dbt-duckdb + dbt-postgres
API backend : FastAPI (Python 3.11+)
ORM : SQLAlchemy 2.x
Authentification : Keycloak (SSO, RBAC)
Conteneurs : Docker Compose v2
Migrations : Alembic
Interface utilisateur : Streamlit 1.50 (pages d'administration)
Gestion de versions : Git / GitHub Enterprise
Systèmes d'exploitation : Linux (SLES en production, Ubuntu en développement)
Responsabilités principales
Compétences et qualifications
Indispensable :
Atouts supplémentaires :
Expérience avec dbt (quel que soit l'adaptateur)
Expérience avec DuckDB ou d'autres moteurs analytiques (ClickHouse, Snowflake, BigQuery)
FastAPI et conception d'API REST
Alembic ou outils de migration de bases de données
Extraction de données SAP (IDocs, BAPIs, RFC ou exports de fichiers)
Mise en oeuvre de Keycloak, SSO ou RBAC
Expérience dans des environnements industriels, de production ou de données produit
Français courant, langue de travail de l'équipe et des interlocuteurs
Pourquoi postuler
Processus de recrutement
Environnement
#Bull
_________________________
Rejoignez notre communauté !
Ici, vos idées, votre curiosité et votre excellence technique contribuent directement à façonner la prochaine ère du calcul avancé - en créant de la valeur pour les entreprises, en accélérant le progrès scientifique et en générant un impact positif pour la société.