Angesagte GitHub-Projekte.
Repos mit dem Tag topic:databricks (Open-Source-Tools, Integrationen und Accelerators auf oder rund um Databricks). Ohne die offiziellen Repos, die bereits unter Releases erscheinen.
dbeaver
Kostenloses universelles Datenbanktool und SQL-Client
redash
Machen Sie Ihr Unternehmen datengesteuert. Verbinden Sie sich mit beliebigen Datenquellen, visualisieren, dashboarden und teilen Sie Ihre Daten einfach.
cube
📊 Cube Core ist eine Open-Source-Semantic-Layer für KI, BI und eingebettete Analysen
APIJSON
🏆 Echtzeit-No-Code, leistungsstarkes und sicheres ORM 🚀 Bereitstellung von APIs und Dokumentation ohne Codierung durch das Backend, Frontend (Client) kann Antwort-JSONs anpassen 🏆 实时 零代码、全功能、强安全 ORM 库 🚀 后端接口和文档零代码,前端(客户端) 定制返回 JSON 的数据和结构
WrenAI
GenBI (Generative BI) für KI-Agenten: ein Open-Source- und governiertes Text-to-SQL über eine offene Kontextschicht, das natürlichsprachliche Fragen in vertrauenswürdige Dashboards, Charts und SQL über 20+ Datenquellen wie BigQuery, Snowflake, PostgreSQL, ClickHouse, Amazon Redshift, Databricks und mehr umwandelt
sqlglot
Python SQL Parser und Transpiler
growthbook
Open-Source-Feature-Flags, Experimente und Produktanalysen
SynapseML
Einfaches und verteiltes maschinelles Lernen
spark
.NET for Apache Spark macht Apache Spark für .NET-Entwickler leicht zugänglich
ai-dev-kit
Databricks Toolkit für Coding Agents, bereitgestellt vom Field Engineering
multiwoven
🔥🔥🔥 Open-Source Reverse ETL – Alternative zu Hightouch und Census
nao
👾 nao ist ein Open-Source-Analyseagent. (1) Erstellen Sie Kontext mit der nao-core CLI, (2) stellen Sie die nao-Chat-Oberfläche für alle bereit.
zingg
Skalierbares Stammdatenmanagement, Identitätsauflösung, Entitätsauflösung und Deduplizierung mittels ML
datacontract-cli
Datenverträge durchsetzen
altimate-code
Open-Source Agentic-Daten-Engineering-Harness für dbt, SQL und Cloud-Warehouses. Über 100 Tools, 10 Warehouses, KI-gestützt.
mlops-stacks
Dieses Repository bietet einen anpassbaren Stack für den Start neuer ML-Projekte auf Databricks, der sofort bewährte Produktionspraktiken berücksichtigt.
drawio-ai-kit
Bringen Sie Ihrer KI bei, korrekte, schöne draw.io-Diagramme zu zeichnen — deklarative Layout-Engine, Ground-Truth-Schablonen, struktureller Validator, visuelle Selbstprüfung. AWS, Azure, GCP, Databricks, BPMN. Keine Abhängigkeiten.
dataflare
Einfacher, benutzerfreundlicher Datenbankmanager
Lynkr
Optimieren Sie Ihren Workflow mit Lynkr, einem CLI-Tool, das als HTTP-Proxy für effiziente Code-Interaktionen mit Claude Code CLI fungiert
sqlkit
Agentic SQL-Datenbankmanager für über 40 Datenbanken — PostgreSQL, MySQL, SQL Server, SQLite, DuckDB, ClickHouse, Oracle und mehr. Leichtgewichtig, datenschutzorientiert, KI-gestützt, plattformübergreifend. Entwickelt mit Tauri (Rust).
dbldatagen
Schnelle Generierung relevanter synthetischer Daten für Ihre Projekte
spark
Direkter Ersatz für Apache Spark UI
dbx
🧱 Databricks CLI eXtensions (dbx) – Ein CLI-Tool für die Entwicklung und das erweiterte Databricks-Workflow-Management
dqx
Databricks-Framework zur Validierung der Datenqualität von pySpark DataFrames und Tabellen
databricks_bootcamp_2026
End-to-End Data Lakehouse-Projekt auf Databricks, basierend auf der Medallion-Architektur (Bronze, Silver, Gold). Umfasst reale Data Engineering- und Analyse-Workflows mit Spark, PySpark, SQL, Delta Lake und Unity Catalog. Konzipiert für Lernen, Portfolio-Aufbau und Vorstellungsgespräche.
Dataflare
Schnell. Einfach. Datenbankmanager.
terraform-databricks-examples
Beispiele für die Bereitstellung von Databricks-Ressourcen mit Terraform
rocky
Eine SQL-Transformations-Engine, die Ihre gesamte Pipeline typüberprüft und Breaking Changes vor der Ausführung erkennt — Branches, Replay, Spalten-Level-Lineage, Compile-Time-Contracts, Kosten pro Modell. Adapter: Databricks, Snowflake, BigQuery, DuckDB. Ein einziges statisches Rust-Binary. Apache 2.0.
lakehouse-engine
Die Lakehouse Engine ist ein konfigurationsgesteuertes Spark-Framework, geschrieben in Python, das als skalierbare und verteilte Engine für verschiedene Lakehouse-Algorithmen, Datenflüsse und Dienstprogramme für Datenprodukte dient.
dlt-meta
Metadaten-gesteuertes Spark Declarative Pipelines Framework für Bronze/Silver-Pipelines
databricks-code-practice
Databricks-Programmierkenntnisse mit praktischen Übungen trainieren. In Databricks Free Edition importieren, Code schreiben, Assertions ausführen, Erfolg/Misserfolg prüfen. Behandelt Delta Lake, Spark SQL, PySpark, Auto Loader, Medaillon-Architektur, Fensterfunktionen und mehr.
databricks-sql-python
Databricks SQL Connector for Python
owox-data-marts
Open-Source Self-Service-Analyseplattform
analytics-toolbox-core
Ein Satz von UDFs und Prozeduren zur Erweiterung von BigQuery, Snowflake, Redshift, Postgres und Databricks um räumliche Analysefunktionen
universql
Compute-Pushdown von Snowflake zu DuckDB auf Ihrer Infrastruktur
stowage
Schlankes Cloud-Speicher-SDK ohne unnötigen Ballast
databricks-apps-cookbook
Sofort einsatzbereite Code-Snippets zum Erstellen interaktiver Databricks-Apps
scalable-data-science
Skalierbare Datenwissenschaft: Kursreihen in Big Data mit Apache Spark auf Databricks und deren mathematische, statistische und rechnerische Grundlagen mit SageMath
lakebridge
Beschleunigt Migrationen zu Databricks durch Automatisierung wichtiger Migrationsaktivitäten
VariantSpark
Maschinelles Lernen für genomische Varianten
