Radar Data Engineering : outils et tendances
Momentum fondé sur les relevés disponibles sur 7 jours pour Data Engineering : mesuré avec deux relevés, estimé sinon. Chaque valeur indique sa propre fenêtre source. Cette page lit uniquement les relevés déjà stockés.
Filtres du radar
Ce qui bouge
Sur 20 outils comparables dans Data Engineering, 20 progressent, 0 restent stables et 0 reculent. arrow affiche la plus forte hausse mesurée : +459137 téléchargements crates.io sur 90 jours. Ces mouvements décrivent uniquement l’évolution des métriques collectées sur la période.
Période mesurée : 30/08/2026 au 05/09/2026
Classement des outils
Classement par progressions mesurées, normalisées entre sources. Les valeurs brutes gardent leur fenêtre propre, indiquée sous chaque outil ; une variation exige au moins deux relevés sur les 7 derniers jours.
- 1InconnuDernier commit : donnée indisponible
polars
BibliothèqueBibliothèque DataFrame très rapide.
Reformulée en françaispypiprogression mesuréeVoir la source ↗
Installer
pip install polars12 560 961téléchargements sur 7 jours+128 367 (+1.0 %) - 2InconnuDernier commit : donnée indisponible
duckdb
BibliothèqueDuckDB est une base de données SQL intégrée au processus.
Reformulée en françaispypiprogression mesuréeVoir la source ↗
Installer
pip install duckdb11 594 598téléchargements sur 7 jours+106 823 (+0.93 %) - 3Actif
Sparkle
BibliothèqueFramework de mise à jour logicielle pour macOS.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
9 634étoiles GitHub+34 (+0.35 %) - 4Actif
spark-vllm-docker
AutreConfiguration Docker pour exécuter VLLM sur dual DGX Sparks.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
2 211étoiles GitHub+9 (+0.41 %) - 5Actif
steampipe
AutreOutil de requête en direct qui permet d'interroger des APIs, du code et d'autres sources avec SQL sans base de données requise.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
7 947étoiles GitHub+11 (+0.14 %) - 6Actif
sparkle
AutreApplication Windows pour nettoyer et optimiser les performances d'un ordinateur personnel.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
2 074étoiles GitHub+6 (+0.29 %) - 7Actif
splink
AutreOutil de rapprochement probabiliste de données rapide et précis avec support pour plusieurs backends SQL.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
2 375étoiles GitHub+6 (+0.25 %) - 81 799étoiles GitHub+3 (+0.17 %)
- 9Actif
devlake
AutrePlateforme open-source de données DevOps qui ingère et analyse les données fragmentées des outils DevOps pour extraire des insights sur l'excellence technique et l'expérience développeur.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
3 119étoiles GitHub+3 (+0.10 %) - 10346étoiles GitHub+1 (+0.29 %)
- 11Actif
dbt-clickhouse
AutrePlugin Clickhouse pour dbt.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
361étoiles GitHub+1 (+0.28 %) - 12Actif
dbt-databricks
AutreAdaptateur dbt pour Databricks.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
376étoiles GitHub+1 (+0.27 %) - 13Actif
Extension VSCode qui intègre dbt avec autocomplétion, aperçu, lignage des colonnes, génération d'AI docs, vérifications de santé et estimation de coûts.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
585étoiles GitHub+1 (+0.17 %) - 14575étoiles GitHub+1 (+0.17 %)
- 15Actif
kyuubi
AutrePasserelle distribuée et multi-locataire Apache Kyuubi pour fournir du SQL serverless sur les entrepôts de données et lakehouses.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
2 364étoiles GitHub+1 (+0.04 %) - 16Actif
RoaringBitmap
AutreImplémentation optimisée de bitset compressé en Java utilisée par Apache Spark et d'autres projets.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
3 923étoiles GitHub+1 (+0.03 %) - 173 643étoiles GitHub+1 (+0.03 %)
- 18Actif
linkis
AutreApache Linkis crée une couche middleware de calcul pour faciliter la connexion, la gouvernance et l'orchestration entre les applications et les moteurs de données sous-jacents.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
3 411étoiles GitHub+1 (+0.03 %) - 19InconnuDernier commit : donnée indisponible
dagster
BibliothèqueDagster est une plateforme d'orchestration pour le développement, la production et l'observation des ressources de données.
Reformulée en françaispypiprogression mesuréeVoir la source ↗
Installer
pip install dagster1 777 910téléchargements sur 7 jours-146 610 (-7.6 %) - 20InconnuDernier commit : donnée indisponible
dbt-core
Bibliothèquedbt permet aux analystes et ingénieurs données de construire des analyses selon les méthodes d'ingénierie logicielle.
Reformulée en françaispypiprogression mesuréeVoir la source ↗
Installer
pip install dbt-core5 213 392téléchargements sur 7 jours-3 070 695 (-37.1 %) - 21Actif
spark-nlp
AutreBibliothèque de traitement du langage naturel pour l'extraction d'entités, la classification de texte, la traduction et l'analyse de sentiment.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
4 160étoiles GitHubstable - 22Actif
ytsaurus
AutrePlateforme open-source de big data évolutive et tolérante aux pannes.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
2 203étoiles GitHubstable - 23Actif
dbt-metabase
AutreIntégration dbt et Metabase pour l'analytique et la visualisation de données.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
612étoiles GitHubstable
Ressources pédagogiques et de référence
Classement par progressions mesurées, normalisées entre sources. Ces ressources restent accessibles séparément et ne participent pas au classement principal des outils.
- 17 237étoiles GitHub+3 (+0.04 %)
- 2ActifVoir la source ↗
awesome-dbt
AutreListe curatée de ressources dbt et d'ingénierie analytique.
Reformulée en françaisgithubRessourceprogression mesurée1 721étoiles GitHubstable