Projets GitHub en vogue.
Dépôts marqués topic:databricks : outils open source, intégrations et accélérateurs conçus sur ou autour de Databricks. Exclut les dépôts officiels déjà traités dans Releases.
dbeaver
Outil de base de données universel et client SQL gratuits
redash
Faites de votre entreprise une entreprise axée sur les données. Connectez-vous à n'importe quelle source de données, visualisez, créez des tableaux de bord et partagez facilement vos données.
cube
📊 Cube Core est une couche sémantique open source pour l'IA, la BI et l'analyse intégrée
APIJSON
🏆 ORM temps réel sans code, puissant et sécurisé 🚀 Fourniture d'API et de documentation sans codage par le backend, le frontend (client) peut personnaliser les JSON de réponse 🏆 实时 零代码、全功能、强安全 ORM 库 🚀 后端接口和文档零代码,前端(客户端) 定制返回 JSON 的数据和结构
WrenAI
GenBI (Generative BI) pour les agents IA : un outil text-to-SQL open-source et gouverné via une couche de contexte ouverte qui transforme les questions en langage naturel en tableaux de bord, graphiques et requêtes SQL fiables sur plus de 20 sources de données telles que BigQuery, Snowflake, PostgreSQL, ClickHouse, Amazon Redshift, Databricks et bien d'autres
sqlglot
Analyseur et transpiler SQL Python
growthbook
Indicateurs de fonctionnalités open source, expérimentation et analyse de produits
SynapseML
Apprentissage automatique simple et distribué
spark
.NET pour Apache Spark rend Apache Spark facilement accessible aux développeurs .NET
ai-dev-kit
Boîte à outils Databricks pour les agents de codage, fournie par l'ingénierie de terrain
multiwoven
🔥🔥🔥 Reverse ETL open source – Une alternative à Hightouch et Census
nao
👾 nao est un agent d'analyse open source. (1) Créez du contexte avec l'interface de ligne de commande nao-core, (2) déployez l'interface de chat nao pour tous.
zingg
Gestion évolutive des données de référence, résolution d'identité, résolution d'entité et déduplication à l'aide du ML
datacontract-cli
Appliquer les contrats de données
altimate-code
Harnais open source d'ingénierie de données agentic pour dbt, SQL et les entrepôts cloud. Plus de 100 outils, 10 entrepôts, optimisé par l'IA.
mlops-stacks
Ce dépôt fournit une pile personnalisable pour démarrer de nouveaux projets ML sur Databricks qui suivent les meilleures pratiques de production dès le départ.
drawio-ai-kit
Apprenez à votre IA à dessiner des diagrammes draw.io corrects et esthétiques — moteur de mise en page déclaratif, pochoirs de référence, validateur structurel, auto-vérification visuelle. AWS, Azure, GCP, Databricks, BPMN. Zéro dépendance.
dataflare
Gestionnaire de base de données simple et facile à utiliser
Lynkr
Rationalisez votre flux de travail avec Lynkr, un outil CLI qui agit comme un proxy HTTP pour des interactions de code efficaces à l'aide de Claude Code CLI
sqlkit
Gestionnaire de base de données SQL agentique pour plus de 40 bases de données — PostgreSQL, MySQL, SQL Server, SQLite, DuckDB, ClickHouse, Oracle et plus encore. Léger, axé sur la confidentialité, propulsé par l'IA, multiplateforme. Conçu avec Tauri (Rust).
dbldatagen
Générez rapidement des données synthétiques pertinentes pour vos projets
spark
Remplacement direct de l'interface utilisateur Apache Spark
dbx
🧱 Databricks CLI eXtensions (dbx) – Un outil CLI pour le développement et la gestion avancée des workflows Databricks
dqx
Databricks : un framework pour valider la qualité des données des DataFrames et tables pySpark
databricks_bootcamp_2026
Projet Data Lakehouse de bout en bout construit sur Databricks, suivant l'architecture Medallion (Bronze, Silver, Gold). Couvre les workflows réels d'ingénierie et d'analyse de données utilisant Spark, PySpark, SQL, Delta Lake et Unity Catalog. Conçu pour l'apprentissage, la création de portfolio et les entretiens d'embauche.
Dataflare
Rapide. Simple. Gestionnaire de base de données.
terraform-databricks-examples
Exemples d'utilisation de Terraform pour déployer des ressources Databricks
lakehouse-engine
Le Lakehouse Engine est un framework Spark piloté par la configuration, écrit en Python, servant de moteur scalable et distribué pour plusieurs algorithmes Lakehouse, flux de données et utilitaires pour les produits de données.
rocky
Un moteur de transformation SQL qui vérifie le type de l'ensemble de votre pipeline et détecte les changements cassants avant leur exécution — branches, relecture, lignage au niveau des colonnes, contrats au moment de la compilation, coût par modèle. Adaptateurs : Databricks, Snowflake, BigQuery, DuckDB. Un seul binaire Rust statique. Apache 2.0.
dlt-meta
Framework de pipelines déclaratifs Spark piloté par les métadonnées pour les pipelines bronze/silver
databricks-code-practice
Pratiquez vos compétences de codage Databricks avec des exercices pratiques. Importez dans Databricks Free Edition, écrivez du code, exécutez des assertions, vérifiez la réussite/l'échec. Couvre Delta Lake, Spark SQL, PySpark, Auto Loader, l'architecture en médaillon, les fonctions de fenêtre, et plus encore.
databricks-sql-python
Databricks SQL Connector for Python
owox-data-marts
Plateforme d'analyse en libre-service open source
analytics-toolbox-core
Un ensemble de fonctions UDF et de procédures pour étendre les capacités d'analyse spatiale de BigQuery, Snowflake, Redshift, Postgres et Databricks
universql
Déploiement de la puissance de calcul de Snowflake vers DuckDB sur votre infrastructure
stowage
SDK de stockage cloud épuré et sans fioritures
databricks-apps-cookbook
Extraits de code prêts à l'emploi pour créer des applications Databricks interactives
scalable-data-science
Science des données évolutive : cours sur le Big Data utilisant Apache Spark sur Databricks et leurs fondations mathématiques, statistiques et computationnelles avec SageMath
lakebridge
Accélère les migrations vers Databricks en automatisant les activités de migration clés
VariantSpark
L'apprentissage automatique pour les variants génomiques
