Aller au contenu
← Toutes les actus
Databricks Blog6 octobre 2026

Mise à l'échelle et exploitation d'un grand projet dbt sur Databricks : l'équipe data d'IFCO aborde performance, visibilité et débogage

Traduit de l'original anglais par IA. Voir en anglais

Résumé

L'optimisation des modèles incrémentaux dbt grâce au liquid clustering, au dynamic file pruning et à des stratégies de fusion réfléchies a réduit le temps d'exécution des tâches principales d'IFCO de plus de 60 % et a permis de supprimer les rafraîchissements complets nocturnes. En diagnostiquant les plans de requêtes réellement exécutés et en orchestrant les modèles sous forme de tâches Databricks Jobs distinctes via l'outil open source databricks-dbt-factory, l'équipe a gagné en visibilité par modèle, en exécutions ciblées et en tests renforcés.

* Optimisation des modèles incrémentaux dbt afin que chaque exécution n'écrive que les lignes modifiées, en utilisant le liquid clustering, une stratégie de fusion réfléchie et le dynamic file pruning. Cela a réduit le temps d'exécution des tâches principales d'IFCO de plus de 60 % et a éliminé le rafraîchissement complet nocturne. * Diagnostic des modèles lents à partir du plan de requête réellement exécuté, et non du SQL compilé, car c'est là qu'apparaissent les véritables causes. IFCO a intégré ce diagnostic dans une compétence réutilisable exécutée sur chaque modèle. * Exécution du projet dbt sous forme d'une tâche par modèle sur Databricks Jobs avec l'outil open source databricks-dbt-factory, plutôt qu'en tant que tâche unique opaque. Cela offre une visibilité par modèle, des réexécutions ciblées et des tests obligatoires.

Articles similaires

News

Le serveur MCP publicitaire de Meta arrive sur Databricks : mettez votre intelligence client au service de vos campagnes publicitaires

databricks-blog3h ago
News

NEAREST BY Join : mise à l'échelle de la recherche vectorielle dans Databricks Runtime

databricks-blog20h ago
News

Libérer la portabilité des données : prévenir le verrouillage de catalogue avec les API REGISTER et UNREGISTER

databricks-blog1d ago
News

Comment Genie Ontology propulse le développement de produits chez Databricks

databricks-blog1d ago