注目のGitHubプロジェクト
topic:databricks が付いたリポジトリ。Databricks 上で、あるいは Databricks 周辺で作られたオープンソースのツール、連携、アクセラレーター。Releases ですでに扱っている公式リポジトリは除きます。
dbeaver
無料のユニバーサルデータベースツールとSQLクライアント
redash
企業をデータドリブンに。あらゆるデータソースに接続し、データを簡単に可視化、ダッシュボード化、共有。
cube
📊 Cube CoreはAI、BI、組み込み分析のためのオープンソースのセマンティックレイヤー
APIJSON
🏆 リアルタイムのノーコード、強力でセキュアなORM 🚀 バックエンドによるAPIとドキュメントのノーコード提供、フロントエンド(クライアント)によるレスポンスJSONのカスタマイズ 🏆 实时 零代码、全功能、强安全 ORM 库 🚀 后端接口和文档零代码,前端(客户端) 定制返回 JSON 的数据和结构
WrenAI
AIエージェント向けGenBI(Generative BI):BigQuery、Snowflake、Databricksなど20以上のデータソースに対応し、オープンなコンテキストレイヤーを介して自然言語の質問を信頼性の高いダッシュボード、チャート、SQLに変換するオープンソースかつガバナンスの効いたテキストto-SQLツール
sqlglot
Python SQL ParserとTranspiler
growthbook
オープンソースの機能フラグ、実験、製品分析
SynapseML
シンプルで分散型の機械学習
spark
.NET for Apache Sparkにより、.NET開発者はApache Sparkに容易にアクセス可能に
ai-dev-kit
Databricksフィールドエンジニアリングが提供するコーディングエージェント向けツールキット
multiwoven
🔥🔥🔥 オープンソースのリバースETL — HightouchとCensusの代替
nao
👾 naoはオープンソースの分析エージェントです。(1) nao-core CLIでコンテキストを作成し、(2) naoチャットインターフェースを全員に展開します。
zingg
MLを活用したスケーラブルなマスターデータ管理、ID解決、エンティティ解決、重複排除
datacontract-cli
データ契約を適用
altimate-code
dbt、SQL、クラウドウェアハウス向けのオープンソースのagenticデータエンジニアリングハーネス。100以上のツール、10のウェアハウス、AI搭載。
mlops-stacks
このリポジトリは、Databricksで本番環境のベストプラクティスに則った新しいMLプロジェクトを開始するための、カスタマイズ可能なスタックを提供します。
drawio-ai-kit
AIに正確で美しいdraw.io構成図を描かせる方法 — 宣言的レイアウトエンジン、公式ステンシル、構造バリデータ、ビジョン自己チェック。AWS、Azure、GCP、Databricks、BPMNに対応。依存関係ゼロ。
dataflare
シンプルで使いやすいデータベースマネージャー
Lynkr
Claude Code CLI を使用した効率的なコード操作のための HTTP プロキシとして機能する CLI ツール Lynkr でワークフローを合理化
sqlkit
40以上のデータベースに対応するエージェント型SQLデータベース管理ツール — PostgreSQL、MySQL、SQL Server、SQLite、DuckDB、ClickHouse、Oracleなど。軽量、プライバシー重視、AI搭載、クロスプラットフォーム対応。Tauri(Rust)で構築。
dbldatagen
プロジェクト向けに関連性の高い合成データを迅速に生成
spark
Apache Spark UIのドロップイン代替
dbx
🧱 Databricks CLI eXtensions (dbx) – Databricksの高度なワークフロー管理と開発のためのCLIツール
dqx
Databricks、pySpark DataFrameとテーブルのデータ品質を検証するフレームワークを発表
databricks_bootcamp_2026
Databricks上に構築されたエンドツーエンドのData Lakehouseプロジェクト:Medallionアーキテクチャ(Bronze、Silver、Gold)に準拠。Spark、PySpark、SQL、Delta Lake、Unity Catalogを使用した実世界のデータエンジニアリングと分析ワークフローを網羅。学習、ポートフォリオ構築、就職面接向けに設計。
Dataflare
高速、シンプル、データベースマネージャー
terraform-databricks-examples
Terraform を使用した Databricks リソースのデプロイ例
lakehouse-engine
Lakehouse Engineは、データ製品向けのLakehouseアルゴリズム、データフロー、ユーティリティをスケーラブルかつ分散型で処理する、Pythonで書かれた構成駆動型Sparkフレームワークです。
rocky
パイプライン全体を型チェックし、実行前に破壊的変更を捕捉するSQL変換エンジン — ブランチ、リプレイ、列レベルの系列、コンパイル時コントラクト、モデルごとのコスト。アダプター:Databricks、Snowflake、BigQuery、DuckDB。単一の静的Rustバイナリ。Apache 2.0。
dlt-meta
メタデータ駆動型Spark宣言的パイプラインフレームワークによるbronze/silverパイプライン
databricks-code-practice
実践的な演習でDatabricksのコーディングスキルを習得。Databricks Free Editionにインポートし、コードを記述、アサーションを実行、合否を確認。Delta Lake、Spark SQL、PySpark、Auto Loader、メダリオンアーキテクチャ、ウィンドウ関数などを網羅。
databricks-sql-python
Databricks SQL Connector for Python
owox-data-marts
オープンソースのセルフサービス分析プラットフォーム
analytics-toolbox-core
BigQuery、Snowflake、Redshift、Postgres、Databricksを空間分析機能で拡張するUDFとプロシージャのセット
universql
SnowflakeからDuckDBへのコンピュートプッシュダウンを自社インフラで実行
stowage
無駄がなく、余計な機能のないクラウドストレージSDK
databricks-apps-cookbook
インタラクティブなDatabricksアプリ構築のためのすぐに使えるコードスニペット
scalable-data-science
Databricks上のApache SparkとSageMathを用いたスケーラブルなデータサイエンスコース
lakebridge
主要な移行アクティビティを自動化し、Databricksへの移行を加速
VariantSpark
ゲノム変異のための機械学習
