Aller au contenu
Projets

Projets GitHub en vogue.

Dépôts marqués topic:databricks : outils open source, intégrations et accélérateurs conçus sur ou autour de Databricks. Exclut les dépôts officiels déjà traités dans Releases.

Language:
dbeaver/dbeaver51.5k

dbeaver

Outil de base de données universel et client SQL gratuits

aidatabasedatabricksdb2
Java4.3kpushed today
getredash/redash28.8k

redash

Faites de votre entreprise une entreprise axée sur les données. Connectez-vous à n'importe quelle source de données, visualisez, créez des tableaux de bord et partagez facilement vos données.

analyticsathenabibigquery
Python4.6kpushed 3d ago
cube-js/cube20.7k

cube

📊 Cube Core est une couche sémantique open source pour l'IA, la BI et l'analyse intégrée

agentic-analyticsagentsaianalytics
Rust2.1kpushed today
Tencent/APIJSON18.4k

APIJSON

🏆 ORM temps réel sans code, puissant et sécurisé 🚀 Fourniture d'API et de documentation sans codage par le backend, le frontend (client) peut personnaliser les JSON de réponse 🏆 实时 零代码、全功能、强安全 ORM 库 🚀 后端接口和文档零代码,前端(客户端) 定制返回 JSON 的数据和结构

baasclickhousecruddatabricks
Java2.3kpushed 5d ago
Canner/WrenAI17.3k

WrenAI

GenBI (Generative BI) pour les agents IA : un outil text-to-SQL open-source et gouverné via une couche de contexte ouverte qui transforme les questions en langage naturel en tableaux de bord, graphiques et requêtes SQL fiables sur plus de 20 sources de données telles que BigQuery, Snowflake, PostgreSQL, ClickHouse, Amazon Redshift, Databricks et bien d'autres

ai-agentsbigquerybusiness-intelligencecharts
Python2.0kpushed today
tobymao/sqlglot9.6k

sqlglot

Analyseur et transpiler SQL Python

bigqueryclickhousedatabricksduckdb
Python1.3kpushed today
growthbook/growthbook8.1k

growthbook

Indicateurs de fonctionnalités open source, expérimentation et analyse de produits

ab-testingabtestabtestinganalytics
TypeScript815pushed today
microsoft/SynapseML5.2k

SynapseML

Apprentissage automatique simple et distribué

aiapache-sparkazurebig-data
Scala866pushed today
dotnet/spark2.1k

spark

.NET pour Apache Spark rend Apache Spark facilement accessible aux développeurs .NET

analyticsapache-sparkazurebigdata
C#334pushed 2d ago
databricks-solutions/ai-dev-kit1.9k

ai-dev-kit

Boîte à outils Databricks pour les agents de codage, fournie par l'ingénierie de terrain

agentsclaudecursordatabricks
Python405pushed 1w ago
Multiwoven/multiwoven1.7k

multiwoven

🔥🔥🔥 Reverse ETL open source – Une alternative à Hightouch et Census

bigquerycdpcustomer-data-platformdata-activation
Ruby95pushed today
getnao/nao1.6k

nao

👾 nao est un agent d'analyse open source. (1) Créez du contexte avec l'interface de ligne de commande nao-core, (2) déployez l'interface de chat nao pour tous.

agentic-analyticsanalyticsanalytics-engineeringbigquery
TypeScript239pushed today
zinggAI/zingg1.2k

zingg

Gestion évolutive des données de référence, résolution d'identité, résolution d'entité et déduplication à l'aide du ML

cdpcustomer-data-platformdata-sciencedatabricks
Java175pushed today
datacontract/datacontract-cli1.0k

datacontract-cli

Appliquer les contrats de données

bigquerydata-contractdata-contractsdata-engineering
JavaScript273pushed yesterday
AltimateAI/altimate-code793

altimate-code

Harnais open source d'ingénierie de données agentic pour dbt, SQL et les entrepôts cloud. Plus de 100 outils, 10 entrepôts, optimisé par l'IA.

agentagentic-data-engineeringaianalytics-engineering
TypeScript133pushed today
databricks/mlops-stacks710

mlops-stacks

Ce dépôt fournit une pile personnalisable pour démarrer de nouveaux projets ML sur Databricks qui suivent les meilleures pratiques de production dès le départ.

databricksmachine-learningmlops
Go Template266pushed 1w ago
sparklabx/drawio-ai-kit632

drawio-ai-kit

Apprenez à votre IA à dessiner des diagrammes draw.io corrects et esthétiques — moteur de mise en page déclaratif, pochoirs de référence, validateur structurel, auto-vérification visuelle. AWS, Azure, GCP, Databricks, BPMN. Zéro dépendance.

agent-skillsai-agentsarchitecture-diagramsaws
JavaScript111pushed 1w ago
DataflareApp/dataflare596

dataflare

Gestionnaire de base de données simple et facile à utiliser

bigqueryclickhousecloudflare-d1cloudflare-r2
TypeScript37pushed 4d ago
Fast-Editor/Lynkr542

Lynkr

Rationalisez votre flux de travail avec Lynkr, un outil CLI qui agit comme un proxy HTTP pour des interactions de code efficaces à l'aide de Claude Code CLI

agentsaiai-gatewayclaude
JavaScript59pushed yesterday
geek-fun/sqlkit541

sqlkit

Gestionnaire de base de données SQL agentique pour plus de 40 bases de données — PostgreSQL, MySQL, SQL Server, SQLite, DuckDB, ClickHouse, Oracle et plus encore. Léger, axé sur la confidentialité, propulsé par l'IA, multiplateforme. Conçu avec Tauri (Rust).

bigqueryclickhousecockroachdbcross-platform
Rust10pushed 4d ago
databrickslabs/dbldatagen489

dbldatagen

Générez rapidement des données synthétiques pertinentes pour vos projets

data-generationdatabricksdatagendatageneration
Python103pushed 2w ago
dataflint/spark485

spark

Remplacement direct de l'interface utilisateur Apache Spark

apache-sparkbig-datadata-pipelinedata-pipelines
TypeScript57pushed yesterday
databrickslabs/dbx462

dbx

🧱 Databricks CLI eXtensions (dbx) – Un outil CLI pour le développement et la gestion avancée des workflows Databricks

cicicddatabricksdatabricks-api
Python128pushed 4mo ago
databrickslabs/dqx447

dqx

Databricks : un framework pour valider la qualité des données des DataFrames et tables pySpark

data-profilingdata-qualitydata-quality-monitoringdatabricks
Python138pushed today
DataWithBaraa/databricks_bootcamp_2026388

databricks_bootcamp_2026

Projet Data Lakehouse de bout en bout construit sur Databricks, suivant l'architecture Medallion (Bronze, Silver, Gold). Couvre les workflows réels d'ingénierie et d'analyse de données utilisant Spark, PySpark, SQL, Delta Lake et Unity Catalog. Conçu pour l'apprentissage, la création de portfolio et les entretiens d'embauche.

aiapache-sparkdata-analyticsdata-engineering
Jupyter Notebook181pushed 7mo ago
DataflareApp/Dataflare383

Dataflare

Rapide. Simple. Gestionnaire de base de données.

bigqueryclickhousecloudflare-d1cloudflare-r2
17pushed 4mo ago
databricks/terraform-databricks-examples338

terraform-databricks-examples

Exemples d'utilisation de Terraform pour déployer des ressources Databricks

awsazuredatabricksdatabricks-module
HCL224pushed 1w ago
adidas/lakehouse-engine294

lakehouse-engine

Le Lakehouse Engine est un framework Spark piloté par la configuration, écrit en Python, servant de moteur scalable et distribué pour plusieurs algorithmes Lakehouse, flux de données et utilitaires pour les produits de données.

big-dataconfiguration-drivendata-engineeringdata-quality
Python52pushed 3d ago
rocky-data/rocky294

rocky

Un moteur de transformation SQL qui vérifie le type de l'ensemble de votre pipeline et détecte les changements cassants avant leur exécution — branches, relecture, lignage au niveau des colonnes, contrats au moment de la compilation, coût par modèle. Adaptateurs : Databricks, Snowflake, BigQuery, DuckDB. Un seul binaire Rust statique. Apache 2.0.

bigquerycolumn-lineagedagsterdata-contracts
Rust16pushed today
databrickslabs/dlt-meta273

dlt-meta

Framework de pipelines déclaratifs Spark piloté par les métadonnées pour les pipelines bronze/silver

databricksdatabricks-cli-installabledltlakeflow-declarative-pipelines
Python129pushed 2d ago
jrlasak/databricks-code-practice257

databricks-code-practice

Pratiquez vos compétences de codage Databricks avec des exercices pratiques. Importez dans Databricks Free Edition, écrivez du code, exécutez des assertions, vérifiez la réussite/l'échec. Couvre Delta Lake, Spark SQL, PySpark, Auto Loader, l'architecture en médaillon, les fonctions de fenêtre, et plus encore.

auto-loadercoding-practicedata-engineeringdatabricks
Python143pushed 3w ago
databricks/databricks-sql-python233

databricks-sql-python

Databricks SQL Connector for Python

databricksdwhpython3sql
Python145pushed today
OWOX/owox-data-marts229

owox-data-marts

Plateforme d'analyse en libre-service open source

analyticsathenabigquerydashboard
TypeScript35pushed today
CartoDB/analytics-toolbox-core209

analytics-toolbox-core

Un ensemble de fonctions UDF et de procédures pour étendre les capacités d'analyse spatiale de BigQuery, Snowflake, Redshift, Postgres et Databricks

analytics-toolboxbigquerycartodatabricks
JavaScript44pushed 4d ago
buremba/universql206

universql

Déploiement de la puissance de calcul de Snowflake vers DuckDB sur votre infrastructure

databricksdbtduckdbproxy-server
Jupyter Notebook7pushed 10mo ago
aloneguid/stowage193

stowage

SDK de stockage cloud épuré et sans fioritures

aws-s3azure-storagedatabricksgcp-storage
C#23pushed 5mo ago
databricks-solutions/databricks-apps-cookbook177

databricks-apps-cookbook

Extraits de code prêts à l'emploi pour créer des applications Databricks interactives

databricksdatabricks-appsweb-application
Python119pushed 3mo ago
lamastex/scalable-data-science166

scalable-data-science

Science des données évolutive : cours sur le Big Data utilisant Apache Spark sur Databricks et leurs fondations mathématiques, statistiques et computationnelles avec SageMath

apache-sparkdata-sciencedatabricksscala
HTML93pushed 11mo ago
databrickslabs/lakebridge148

lakebridge

Accélère les migrations vers Databricks en automatisant les activités de migration clés

code-analysiscode-converterdata-validationdatabricks
Python108pushed 2mo ago
aehrc/VariantSpark147

VariantSpark

L'apprentissage automatique pour les variants génomiques

association-studiesawsbioinformaticsdatabricks
JavaScript48pushed 2mo ago