Services

Ingénierie des données, pipelines et tableaux de bord

Vos données sont dispersées entre tableurs, systèmes et exports. Nous les réunissons en un seul endroit, les tenons à jour automatiquement et les mettons dans des tableaux de bord réellement utilisés.

Ce que nous construisons

De données éparpillées à une source unique et fiable

Pipelines de données (ETL et ELT)

Des pipelines planifiés qui collectent, nettoient et chargent vos données d’eux-mêmes, orchestrés avec Airflow et testés à chaque modification.

Plateformes de données

Un stockage unique et bien modélisé pour vos données, en couches : les fichiers bruts conservés intacts pour que toute erreur puisse être rejouée, des tables propres prêtes pour l’analyse.

Tableaux de bord et reporting

Des tableaux de bord interactifs avec cartes et graphiques, dans Tableau ou intégrés à une application web, alimentés directement par vos pipelines.

Gros volumes et flux

De grands jeux de données traités avec Spark, et des flux gérés avec Kafka quand les données ne peuvent pas attendre.

Notre méthode

Cinq étapes, de vos besoins à un système qui vous appartient

Chaque projet se déroule de la même façon : brief, spécification, développement, déploiement et passation. À la fin, vous recevez le code, la documentation et le runbook, sans frais de licence.

Voir notre méthode

Technologie

Avec quoi nous construisons

Technologies utilisées
  • Python
  • SQL
  • Airflow
  • dbt
  • DuckDB
  • Spark
  • Kafka
  • PostgreSQL
  • MongoDB
  • Parquet
  • Docker
  • AWS
  • Tableau
Questions

Questions fréquentes

Nous n’avons que des tableurs. Est-ce suffisant ?

Oui. Beaucoup de projets partent de tableurs et d’exports. Le pipeline en fait une source propre qui se met à jour toute seule.

Quels outils utilisez-vous ?

Des outils ouverts et standard : Python, SQL, Airflow, dbt, Spark et PostgreSQL, sur AWS ou vos propres serveurs. Rien qui vous enferme.

Quel volume de données peut-il traiter ?

Le pipeline de Waze Cargo traite environ vingt millions d’enregistrements douaniers. Les volumes plus importants tournent sur Spark.

À qui appartiennent les données ?

À vous, toujours. Elles restent dans vos comptes, et à la passation vous recevez le code et le runbook pour tout faire tourner sans nous.

Contactez-nous

Dites-nous ce dont vous avez besoin

Décrivez le problème et imaginez la solution que vous voulez. Nous reviendrons vers vous avec la bonne réponse et le meilleur produit pour vous.