[ Stack technique ]
Apache Spark
Le moteur d'analyse distribué pour traiter des téraoctets.
Spark traite des volumes massifs de données en mémoire à travers un cluster distribué. Ses APIs (DataFrame, SQL, Streaming, MLlib) couvrent batch, stream et machine learning. Couplé à Delta Lake, c'est la fondation des lakehouses modernes.
[ Pourquoi Apache Spark chez Dexon ]
Ce que cette techno fait bien, et pourquoi nous la mobilisons.
Usage typique : ETL grosse volumétrie, lakehouse, ML training distribué.
- 01
Traitement distribué en mémoire : ordres de magnitude vs Hadoop.
- 02
APIs Python, Scala, SQL, R : équipes hétérogènes accommodées.
- 03
Structured Streaming pour le near-real-time.
- 04
Databricks, EMR, Dataproc : managé chez les trois clouds.
[ Technologies complémentaires ]
Les briques que nous mobilisons souvent en parallèle.
Une stack existe rarement seule. Voici les technologies que Dexon associe le plus souvent à celle-ci, par habitude de pipeline, similarité d'usage ou maîtrise interne. Cliquez sur une brique pour voir son périmètre.
[ Réassurance ]
- 0+
- projets livrés sur mesure
- 30
- ingénieurs, designers, chefs de projet
- 80 %
- issus des meilleures écoles FR
- 24 h
- délai moyen de réponse
[ Ils nous font confiance ]
Plus de 100 entreprises françaises et européennes nous accordent leur confiance.
















[ Presse ]
Ils parlent de nous.
Pôle applicatif et data.
Couverture nationale par BFM Business, Le Figaro, Challenges, La Tribune et CNews. Une lecture extérieure de notre travail et de nos innovations.


