Aller au contenu
Projets

Projets GitHub en vogue.

Dépôts marqués topic:databricks : outils open source, intégrations et accélérateurs conçus sur ou autour de Databricks. Exclut les dépôts officiels déjà traités dans Releases.

Language:
dbeaver/dbeaver52.0k

dbeaver

Outil de base de données universel et client SQL gratuits

aidatabasedatabricksdb2
Java4.4kpushed today
getredash/redash28.8k

redash

Faites de votre entreprise une entreprise axée sur les données. Connectez-vous à n'importe quelle source de données, visualisez, créez des tableaux de bord et partagez facilement vos données.

analyticsathenabibigquery
Python4.6kpushed yesterday
cube-js/cube21.0k

cube

📊 Cube Core est une couche sémantique open source pour l'IA, la BI et l'analyse intégrée

agentic-analyticsagentsaianalytics
Rust2.1kpushed today
Tencent/APIJSON18.4k

APIJSON

🏆 ORM temps réel sans code, puissant et sécurisé 🚀 Fourniture d'API et de documentation sans codage par le backend, le frontend (client) peut personnaliser les JSON de réponse 🏆 实时 零代码、全功能、强安全 ORM 库 🚀 后端接口和文档零代码,前端(客户端) 定制返回 JSON 的数据和结构

baasclickhousecruddatabricks
Java2.3kpushed 3w ago
APIJSON/APIJSON18.4k

APIJSON

🏆 ORM sans code en temps réel, puissant et sécurisé 🏆 Fournit des API et des documentations sans code côté backend, tandis que le frontend (client) peut personnaliser les JSON de réponse 🚀

baasclickhousecruddatabricks
Java2.3kpushed yesterday
Canner/WrenAI17.8k

WrenAI

GenBI (Generative BI) pour les agents IA : un outil text-to-SQL open-source et gouverné via une couche de contexte ouverte qui transforme les questions en langage naturel en tableaux de bord, graphiques et requêtes SQL fiables sur plus de 20 sources de données telles que BigQuery, Snowflake, PostgreSQL, ClickHouse, Amazon Redshift, Databricks et bien d'autres

ai-agentsbigquerybusiness-intelligencecharts
Python2.0kpushed today
tobymao/sqlglot9.7k

sqlglot

Analyseur et transpiler SQL Python

bigqueryclickhousedatabricksduckdb
Python1.3kpushed today
Agents365-ai/drawio-skill8.9k

drawio-skill

génération de diagrammes draw.io à partir du langage naturel — 11 préréglages (UML, SysML/MBSE, BPMN, réseau, C4…), 39 outils : base de code/CI/infra → diagramme, image → diagramme modifiable, icônes de produits Databricks, cartes mentales, animation de construction progressive, vue compressée pour dirigeants, runbooks cliquables, bot de diff de PR. Auto-vérification par vision, plus de 10 000 formes. Export en PNG/SVG/PDF/JPG.

agent-skillsarchitecture-diagrambpmnclaude-code
Python625pushed 1mo ago
growthbook/growthbook8.5k

growthbook

Indicateurs de fonctionnalités open source, expérimentation et analyse de produits

ab-testingabtestabtestinganalytics
TypeScript869pushed today
microsoft/SynapseML5.2k

SynapseML

Apprentissage automatique simple et distribué

aiapache-sparkazurebig-data
Scala868pushed 4d ago
dotnet/spark2.1k

spark

.NET pour Apache Spark rend Apache Spark facilement accessible aux développeurs .NET

analyticsapache-sparkazurebigdata
C#331pushed 1w ago
databricks-solutions/ai-dev-kit1.9k

ai-dev-kit

Boîte à outils Databricks pour les agents de codage, fournie par l'ingénierie de terrain

agentsclaudecursordatabricks
Python428pushed 1mo ago
getnao/nao1.7k

nao

👾 nao est un agent d'analyse open source. (1) Créez du contexte avec l'interface de ligne de commande nao-core, (2) déployez l'interface de chat nao pour tous.

agentic-analyticsanalyticsanalytics-engineeringbigquery
TypeScript262pushed today
Multiwoven/multiwoven1.7k

multiwoven

🔥🔥🔥 Reverse ETL open source – Une alternative à Hightouch et Census

bigquerycdpcustomer-data-platformdata-activation
Ruby96pushed today
zinggAI/zingg1.3k

zingg

Gestion évolutive des données de référence, résolution d'identité, résolution d'entité et déduplication à l'aide du ML

cdpcustomer-data-platformdata-sciencedatabricks
Java177pushed 3w ago
datacontract/datacontract-cli1.1k

datacontract-cli

Appliquer les contrats de données

bigquerydata-contractdata-contractsdata-engineering
JavaScript294pushed today
AltimateAI/altimate-code805

altimate-code

Harnais open source d'ingénierie de données agentic pour dbt, SQL et les entrepôts cloud. Plus de 100 outils, 10 entrepôts, optimisé par l'IA.

agentagentic-data-engineeringaianalytics-engineering
TypeScript122pushed today
databricks/mlops-stacks720

mlops-stacks

Ce dépôt fournit une pile personnalisable pour démarrer de nouveaux projets ML sur Databricks qui suivent les meilleures pratiques de production dès le départ.

databricksmachine-learningmlops
Go Template267pushed today
sparklabx/drawio-ai-kit651

drawio-ai-kit

Apprenez à votre IA à dessiner des diagrammes draw.io corrects et esthétiques — moteur de mise en page déclaratif, pochoirs de référence, validateur structurel, auto-vérification visuelle. AWS, Azure, GCP, Databricks, BPMN. Zéro dépendance.

agent-skillsai-agentsarchitecture-diagramsaws
JavaScript122pushed 3d ago
Fast-Editor/Lynkr618

Lynkr

Rationalisez votre flux de travail avec Lynkr, un outil CLI qui agit comme un proxy HTTP pour des interactions de code efficaces à l'aide de Claude Code CLI

agentsaiai-gatewayclaude
JavaScript72pushed today
DataflareApp/dataflare611

dataflare

Gestionnaire de base de données simple et facile à utiliser

bigqueryclickhousecloudflare-d1cloudflare-r2
TypeScript39pushed 4d ago
geek-fun/sqlkit508

sqlkit

Gestionnaire de base de données SQL agentique pour plus de 40 bases de données — PostgreSQL, MySQL, SQL Server, SQLite, DuckDB, ClickHouse, Oracle et plus encore. Léger, axé sur la confidentialité, propulsé par l'IA, multiplateforme. Conçu avec Tauri (Rust).

bigqueryclickhousecockroachdbcross-platform
Rust13pushed today
databrickslabs/dbldatagen499

dbldatagen

Générez rapidement des données synthétiques pertinentes pour vos projets

data-generationdatabricksdatagendatageneration
Python105pushed 2mo ago
dataflint/spark493

spark

Remplacement direct de l'interface utilisateur Apache Spark

apache-sparkbig-datadata-pipelinedata-pipelines
TypeScript58pushed 1mo ago
databrickslabs/dbx465

dbx

🧱 Databricks CLI eXtensions (dbx) – Un outil CLI pour le développement et la gestion avancée des workflows Databricks

cicicddatabricksdatabricks-api
Python128pushed 6mo ago
databrickslabs/dqx464

dqx

Databricks : un framework pour valider la qualité des données des DataFrames et tables pySpark

data-profilingdata-qualitydata-quality-monitoringdatabricks
Python155pushed today
DataWithBaraa/databricks_bootcamp_2026443

databricks_bootcamp_2026

Projet Data Lakehouse de bout en bout construit sur Databricks, suivant l'architecture Medallion (Bronze, Silver, Gold). Couvre les workflows réels d'ingénierie et d'analyse de données utilisant Spark, PySpark, SQL, Delta Lake et Unity Catalog. Conçu pour l'apprentissage, la création de portfolio et les entretiens d'embauche.

aiapache-sparkdata-analyticsdata-engineering
Jupyter Notebook193pushed 8mo ago
DataflareApp/Dataflare383

Dataflare

Rapide. Simple. Gestionnaire de base de données.

bigqueryclickhousecloudflare-d1cloudflare-r2
17pushed 5mo ago
databricks/terraform-databricks-examples343

terraform-databricks-examples

Exemples d'utilisation de Terraform pour déployer des ressources Databricks

awsazuredatabricksdatabricks-module
HCL228pushed 1mo ago
zorost/AI-Engineering-Lab313

AI-Engineering-Lab

Un cours gratuit d'ingénierie IA sur 24 semaines, à son propre rythme : Python, machine learning, LLM, RAG, fine-tuning, agents et MCP, Azure, Vertex et Bedrock, ainsi que Databricks. 43 notebooks exécutables, une étude de cas continue. Sous licence MIT, sans inscription. Par Zorost Intelligence AI Lab.

ai-agentsai-engineeringcoursecurriculum
Jupyter Notebook260pushed 1mo ago
rocky-data/rocky304

rocky

Un moteur de transformation SQL qui vérifie le type de l'ensemble de votre pipeline et détecte les changements cassants avant leur exécution — branches, relecture, lignage au niveau des colonnes, contrats au moment de la compilation, coût par modèle. Adaptateurs : Databricks, Snowflake, BigQuery, DuckDB. Un seul binaire Rust statique. Apache 2.0.

bigquerycolumn-lineagedagsterdata-contracts
Rust19pushed today
adidas/lakehouse-engine292

lakehouse-engine

Le Lakehouse Engine est un framework Spark piloté par la configuration, écrit en Python, servant de moteur scalable et distribué pour plusieurs algorithmes Lakehouse, flux de données et utilitaires pour les produits de données.

big-dataconfiguration-drivendata-engineeringdata-quality
Python54pushed 1mo ago
databrickslabs/sdp-meta289

sdp-meta

Framework Spark Declarative Pipelines piloté par les métadonnées pour les pipelines bronze/silver

databricksdatabricks-cli-installabledltlakeflow-declarative-pipelines
Python141pushed today
databrickslabs/lakemeter-oss286

lakemeter-oss

Estimateur de coûts Databricks open source pour le dimensionnement des charges de travail, la tarification DBU, les coûts cloud et les estimations exportables

cloud-costcost-estimationcost-optimizationdatabricks
Python17pushed 6d ago
jrlasak/databricks-code-practice282

databricks-code-practice

Pratiquez vos compétences de codage Databricks avec des exercices pratiques. Importez dans Databricks Free Edition, écrivez du code, exécutez des assertions, vérifiez la réussite/l'échec. Couvre Delta Lake, Spark SQL, PySpark, Auto Loader, l'architecture en médaillon, les fonctions de fenêtre, et plus encore.

auto-loadercoding-practicedata-engineeringdatabricks
Python157pushed 2mo ago
databrickslabs/dlt-meta275

dlt-meta

Framework de pipelines déclaratifs Spark piloté par les métadonnées pour les pipelines bronze/silver

databricksdatabricks-cli-installabledltlakeflow-declarative-pipelines
Python129pushed 1mo ago
databricks/databricks-sql-python235

databricks-sql-python

Databricks SQL Connector for Python

databricksdwhpython3sql
Python158pushed yesterday
OWOX/owox-data-marts234

owox-data-marts

Plateforme d'analyse en libre-service open source

analyticsathenabigquerydashboard
TypeScript34pushed today
CartoDB/analytics-toolbox-core211

analytics-toolbox-core

Un ensemble de fonctions UDF et de procédures pour étendre les capacités d'analyse spatiale de BigQuery, Snowflake, Redshift, Postgres et Databricks

analytics-toolboxbigquerycartodatabricks
JavaScript43pushed 6d ago
buremba/universql206

universql

Déploiement de la puissance de calcul de Snowflake vers DuckDB sur votre infrastructure

databricksdbtduckdbproxy-server
Jupyter Notebook7pushed 11mo ago
aloneguid/stowage193

stowage

SDK de stockage cloud épuré et sans fioritures

aws-s3azure-storagedatabricksgcp-storage
C#23pushed 7mo ago
databricks-solutions/databricks-apps-cookbook177

databricks-apps-cookbook

Extraits de code prêts à l'emploi pour créer des applications Databricks interactives

databricksdatabricks-appsweb-application
Python119pushed 4mo ago
lamastex/scalable-data-science166

scalable-data-science

Science des données évolutive : cours sur le Big Data utilisant Apache Spark sur Databricks et leurs fondations mathématiques, statistiques et computationnelles avec SageMath

apache-sparkdata-sciencedatabricksscala
HTML93pushed 1y ago
databrickslabs/lakebridge148

lakebridge

Accélère les migrations vers Databricks en automatisant les activités de migration clés

code-analysiscode-converterdata-validationdatabricks
Python108pushed 3mo ago
aehrc/VariantSpark147

VariantSpark

L'apprentissage automatique pour les variants génomiques

association-studiesawsbioinformaticsdatabricks
JavaScript48pushed 3mo ago