Projetos em alta no GitHub.
Repositórios marcados com topic:databricks — ferramentas open source, integrações e aceleradores criados sobre ou em torno do Databricks. Não inclui os repositórios oficiais já cobertos por Releases.
dbeaver
Ferramenta de banco de dados universal e cliente SQL gratuitos
redash
Torne sua empresa orientada a dados. Conecte-se a qualquer fonte de dados, visualize, crie dashboards e compartilhe seus dados facilmente.
cube
📊 Cube Core é uma camada semântica de código aberto para IA, BI e análise incorporada
APIJSON
🏆 ORM em tempo real sem código, poderoso e seguro 🚀 Fornecendo APIs e documentos sem codificação pelo Backend, e o Frontend (Cliente) pode personalizar JSONs de resposta 🏆 实时 零代码、全功能、强安全 ORM 库 🚀 后端接口和文档零代码,前端(客户端) 定制返回 JSON 的数据和结构
WrenAI
GenBI (Generative BI) para agentes de IA: um text-to-SQL de código aberto e governado por meio de uma camada de contexto aberta que transforma perguntas em linguagem natural em painéis, gráficos e SQL confiáveis em mais de 20 fontes de dados, como BigQuery, Snowflake, PostgreSQL, ClickHouse, Amazon Redshift, Databricks e muito mais
sqlglot
Parser e Transpiler SQL Python
growthbook
Feature Flags de código aberto, experimentação e análise de produtos
SynapseML
Aprendizado de máquina simples e distribuído
spark
.NET para Apache Spark torna o Apache Spark facilmente acessível para desenvolvedores .NET
ai-dev-kit
Databricks Toolkit para Agentes de Codificação, fornecido pela Engenharia de Campo
multiwoven
🔥🔥🔥 Reverse ETL de código aberto – Alternativa ao Hightouch e Census
nao
👾 nao é um agente de análise de código aberto. (1) Crie contexto com a CLI nao-core, (2) implante a interface de chat nao para todos.
zingg
Gerenciamento escalável de dados mestre, resolução de identidade, resolução de entidade e deduplicação usando ML
datacontract-cli
Aplicar contratos de dados
altimate-code
Harness agêntico de engenharia de dados de código aberto para dbt, SQL e data warehouses em nuvem. Mais de 100 ferramentas, 10 warehouses, com tecnologia de IA.
mlops-stacks
Este repositório oferece uma pilha personalizável para iniciar novos projetos de ML no Databricks que seguem as melhores práticas de produção de forma imediata.
drawio-ai-kit
Ensine sua IA a desenhar diagramas draw.io corretos e bonitos — mecanismo de layout declarativo, stencils de referência, validador estrutural, autoverificação visual. AWS, Azure, GCP, Databricks, BPMN. Zero dependências.
dataflare
Gerenciador de banco de dados simples e fácil de usar
Lynkr
Simplifique seu fluxo de trabalho com Lynkr, uma ferramenta CLI que atua como um proxy HTTP para interações de código eficientes usando Claude Code CLI
sqlkit
Gerenciador de banco de dados SQL agêntico para mais de 40 bancos de dados — PostgreSQL, MySQL, SQL Server, SQLite, DuckDB, ClickHouse, Oracle e muito mais. Leve, focado em privacidade, com tecnologia de IA, multiplataforma. Desenvolvido com Tauri (Rust).
dbldatagen
Gere dados sintéticos relevantes rapidamente para seus projetos
spark
Substituição direta para Apache Spark UI
dbx
🧱 Databricks CLI eXtensions (dbx) – Uma ferramenta CLI para desenvolvimento e gerenciamento avançado de workflows Databricks
dqx
Databricks: framework para validar a qualidade de dados de DataFrames e tabelas pySpark
databricks_bootcamp_2026
Projeto Data Lakehouse de ponta a ponta construído no Databricks, seguindo a arquitetura Medallion (Bronze, Silver, Gold). Abrange fluxos de trabalho reais de engenharia e análise de dados usando Spark, PySpark, SQL, Delta Lake e Unity Catalog. Projetado para aprendizado, construção de portfólio e entrevistas de emprego.
Dataflare
Rápido. Simples. Gerenciador de banco de dados.
terraform-databricks-examples
Exemplos de uso do Terraform para implantar recursos Databricks
lakehouse-engine
O Lakehouse Engine é um framework Spark orientado por configuração, escrito em Python, que serve como um motor escalável e distribuído para diversos algoritmos Lakehouse, fluxos de dados e utilitários para produtos de dados.
rocky
Um motor de transformação SQL que verifica o tipo de todo o seu pipeline e detecta mudanças disruptivas antes da execução — branches, replay, linhagem em nível de coluna, contratos em tempo de compilação, custo por modelo. Adaptadores: Databricks, Snowflake, BigQuery, DuckDB. Um único binário Rust estático. Apache 2.0.
dlt-meta
Framework de Pipelines Declarativos Spark Orientado por Metadados para Pipelines Bronze/Silver
databricks-code-practice
Pratique habilidades de codificação Databricks com exercícios práticos. Importe para o Databricks Free Edition, escreva código, execute asserções, verifique aprovação/reprovação. Abrange Delta Lake, Spark SQL, PySpark, Auto Loader, arquitetura medallion, funções de janela e muito mais.
databricks-sql-python
Databricks SQL Connector for Python
owox-data-marts
Plataforma de análise self-service de código aberto
analytics-toolbox-core
Um conjunto de UDFs e procedimentos para estender BigQuery, Snowflake, Redshift, Postgres e Databricks com recursos de análise espacial
universql
Pushdown de computação do Snowflake para DuckDB executando em sua infraestrutura
stowage
SDK de armazenamento em nuvem sem inchaço e sem rodeios
databricks-apps-cookbook
Snippets de código prontos para uso na criação de aplicativos Databricks interativos
scalable-data-science
Ciência de dados escalável: cursos em big data usando Apache Spark no Databricks e suas fundações matemáticas, estatísticas e computacionais com SageMath
lakebridge
Acelera migrações para Databricks automatizando atividades chave de migração
VariantSpark
Aprendizado de máquina para variantes genômicas
