Pular para o conteúdo
Projetos

Projetos em alta no GitHub.

Repositórios marcados com topic:databricks — ferramentas open source, integrações e aceleradores criados sobre ou em torno do Databricks. Não inclui os repositórios oficiais já cobertos por Releases.

Language:
dbeaver/dbeaver51.5k

dbeaver

Ferramenta de banco de dados universal e cliente SQL gratuitos

aidatabasedatabricksdb2
Java4.3kpushed today
getredash/redash28.8k

redash

Torne sua empresa orientada a dados. Conecte-se a qualquer fonte de dados, visualize, crie dashboards e compartilhe seus dados facilmente.

analyticsathenabibigquery
Python4.6kpushed 3d ago
cube-js/cube20.7k

cube

📊 Cube Core é uma camada semântica de código aberto para IA, BI e análise incorporada

agentic-analyticsagentsaianalytics
Rust2.1kpushed today
Tencent/APIJSON18.4k

APIJSON

🏆 ORM em tempo real sem código, poderoso e seguro 🚀 Fornecendo APIs e documentos sem codificação pelo Backend, e o Frontend (Cliente) pode personalizar JSONs de resposta 🏆 实时 零代码、全功能、强安全 ORM 库 🚀 后端接口和文档零代码,前端(客户端) 定制返回 JSON 的数据和结构

baasclickhousecruddatabricks
Java2.3kpushed 5d ago
Canner/WrenAI17.3k

WrenAI

GenBI (Generative BI) para agentes de IA: um text-to-SQL de código aberto e governado por meio de uma camada de contexto aberta que transforma perguntas em linguagem natural em painéis, gráficos e SQL confiáveis em mais de 20 fontes de dados, como BigQuery, Snowflake, PostgreSQL, ClickHouse, Amazon Redshift, Databricks e muito mais

ai-agentsbigquerybusiness-intelligencecharts
Python2.0kpushed today
tobymao/sqlglot9.6k

sqlglot

Parser e Transpiler SQL Python

bigqueryclickhousedatabricksduckdb
Python1.3kpushed today
growthbook/growthbook8.1k

growthbook

Feature Flags de código aberto, experimentação e análise de produtos

ab-testingabtestabtestinganalytics
TypeScript815pushed today
microsoft/SynapseML5.2k

SynapseML

Aprendizado de máquina simples e distribuído

aiapache-sparkazurebig-data
Scala866pushed today
dotnet/spark2.1k

spark

.NET para Apache Spark torna o Apache Spark facilmente acessível para desenvolvedores .NET

analyticsapache-sparkazurebigdata
C#334pushed 2d ago
databricks-solutions/ai-dev-kit1.9k

ai-dev-kit

Databricks Toolkit para Agentes de Codificação, fornecido pela Engenharia de Campo

agentsclaudecursordatabricks
Python405pushed 1w ago
Multiwoven/multiwoven1.7k

multiwoven

🔥🔥🔥 Reverse ETL de código aberto – Alternativa ao Hightouch e Census

bigquerycdpcustomer-data-platformdata-activation
Ruby95pushed today
getnao/nao1.6k

nao

👾 nao é um agente de análise de código aberto. (1) Crie contexto com a CLI nao-core, (2) implante a interface de chat nao para todos.

agentic-analyticsanalyticsanalytics-engineeringbigquery
TypeScript239pushed today
zinggAI/zingg1.2k

zingg

Gerenciamento escalável de dados mestre, resolução de identidade, resolução de entidade e deduplicação usando ML

cdpcustomer-data-platformdata-sciencedatabricks
Java175pushed today
datacontract/datacontract-cli1.0k

datacontract-cli

Aplicar contratos de dados

bigquerydata-contractdata-contractsdata-engineering
JavaScript273pushed yesterday
AltimateAI/altimate-code793

altimate-code

Harness agêntico de engenharia de dados de código aberto para dbt, SQL e data warehouses em nuvem. Mais de 100 ferramentas, 10 warehouses, com tecnologia de IA.

agentagentic-data-engineeringaianalytics-engineering
TypeScript133pushed today
databricks/mlops-stacks710

mlops-stacks

Este repositório oferece uma pilha personalizável para iniciar novos projetos de ML no Databricks que seguem as melhores práticas de produção de forma imediata.

databricksmachine-learningmlops
Go Template266pushed 1w ago
sparklabx/drawio-ai-kit632

drawio-ai-kit

Ensine sua IA a desenhar diagramas draw.io corretos e bonitos — mecanismo de layout declarativo, stencils de referência, validador estrutural, autoverificação visual. AWS, Azure, GCP, Databricks, BPMN. Zero dependências.

agent-skillsai-agentsarchitecture-diagramsaws
JavaScript111pushed 1w ago
DataflareApp/dataflare596

dataflare

Gerenciador de banco de dados simples e fácil de usar

bigqueryclickhousecloudflare-d1cloudflare-r2
TypeScript37pushed 4d ago
Fast-Editor/Lynkr542

Lynkr

Simplifique seu fluxo de trabalho com Lynkr, uma ferramenta CLI que atua como um proxy HTTP para interações de código eficientes usando Claude Code CLI

agentsaiai-gatewayclaude
JavaScript59pushed yesterday
geek-fun/sqlkit541

sqlkit

Gerenciador de banco de dados SQL agêntico para mais de 40 bancos de dados — PostgreSQL, MySQL, SQL Server, SQLite, DuckDB, ClickHouse, Oracle e muito mais. Leve, focado em privacidade, com tecnologia de IA, multiplataforma. Desenvolvido com Tauri (Rust).

bigqueryclickhousecockroachdbcross-platform
Rust10pushed 4d ago
databrickslabs/dbldatagen489

dbldatagen

Gere dados sintéticos relevantes rapidamente para seus projetos

data-generationdatabricksdatagendatageneration
Python103pushed 2w ago
dataflint/spark485

spark

Substituição direta para Apache Spark UI

apache-sparkbig-datadata-pipelinedata-pipelines
TypeScript57pushed yesterday
databrickslabs/dbx462

dbx

🧱 Databricks CLI eXtensions (dbx) – Uma ferramenta CLI para desenvolvimento e gerenciamento avançado de workflows Databricks

cicicddatabricksdatabricks-api
Python128pushed 4mo ago
databrickslabs/dqx447

dqx

Databricks: framework para validar a qualidade de dados de DataFrames e tabelas pySpark

data-profilingdata-qualitydata-quality-monitoringdatabricks
Python138pushed today
DataWithBaraa/databricks_bootcamp_2026388

databricks_bootcamp_2026

Projeto Data Lakehouse de ponta a ponta construído no Databricks, seguindo a arquitetura Medallion (Bronze, Silver, Gold). Abrange fluxos de trabalho reais de engenharia e análise de dados usando Spark, PySpark, SQL, Delta Lake e Unity Catalog. Projetado para aprendizado, construção de portfólio e entrevistas de emprego.

aiapache-sparkdata-analyticsdata-engineering
Jupyter Notebook181pushed 7mo ago
DataflareApp/Dataflare383

Dataflare

Rápido. Simples. Gerenciador de banco de dados.

bigqueryclickhousecloudflare-d1cloudflare-r2
17pushed 4mo ago
databricks/terraform-databricks-examples338

terraform-databricks-examples

Exemplos de uso do Terraform para implantar recursos Databricks

awsazuredatabricksdatabricks-module
HCL224pushed 1w ago
adidas/lakehouse-engine294

lakehouse-engine

O Lakehouse Engine é um framework Spark orientado por configuração, escrito em Python, que serve como um motor escalável e distribuído para diversos algoritmos Lakehouse, fluxos de dados e utilitários para produtos de dados.

big-dataconfiguration-drivendata-engineeringdata-quality
Python52pushed 3d ago
rocky-data/rocky294

rocky

Um motor de transformação SQL que verifica o tipo de todo o seu pipeline e detecta mudanças disruptivas antes da execução — branches, replay, linhagem em nível de coluna, contratos em tempo de compilação, custo por modelo. Adaptadores: Databricks, Snowflake, BigQuery, DuckDB. Um único binário Rust estático. Apache 2.0.

bigquerycolumn-lineagedagsterdata-contracts
Rust16pushed today
databrickslabs/dlt-meta273

dlt-meta

Framework de Pipelines Declarativos Spark Orientado por Metadados para Pipelines Bronze/Silver

databricksdatabricks-cli-installabledltlakeflow-declarative-pipelines
Python129pushed 2d ago
jrlasak/databricks-code-practice257

databricks-code-practice

Pratique habilidades de codificação Databricks com exercícios práticos. Importe para o Databricks Free Edition, escreva código, execute asserções, verifique aprovação/reprovação. Abrange Delta Lake, Spark SQL, PySpark, Auto Loader, arquitetura medallion, funções de janela e muito mais.

auto-loadercoding-practicedata-engineeringdatabricks
Python143pushed 3w ago
databricks/databricks-sql-python233

databricks-sql-python

Databricks SQL Connector for Python

databricksdwhpython3sql
Python145pushed today
OWOX/owox-data-marts229

owox-data-marts

Plataforma de análise self-service de código aberto

analyticsathenabigquerydashboard
TypeScript35pushed today
CartoDB/analytics-toolbox-core209

analytics-toolbox-core

Um conjunto de UDFs e procedimentos para estender BigQuery, Snowflake, Redshift, Postgres e Databricks com recursos de análise espacial

analytics-toolboxbigquerycartodatabricks
JavaScript44pushed 4d ago
buremba/universql206

universql

Pushdown de computação do Snowflake para DuckDB executando em sua infraestrutura

databricksdbtduckdbproxy-server
Jupyter Notebook7pushed 10mo ago
aloneguid/stowage193

stowage

SDK de armazenamento em nuvem sem inchaço e sem rodeios

aws-s3azure-storagedatabricksgcp-storage
C#23pushed 5mo ago
databricks-solutions/databricks-apps-cookbook177

databricks-apps-cookbook

Snippets de código prontos para uso na criação de aplicativos Databricks interativos

databricksdatabricks-appsweb-application
Python119pushed 3mo ago
lamastex/scalable-data-science166

scalable-data-science

Ciência de dados escalável: cursos em big data usando Apache Spark no Databricks e suas fundações matemáticas, estatísticas e computacionais com SageMath

apache-sparkdata-sciencedatabricksscala
HTML93pushed 11mo ago
databrickslabs/lakebridge148

lakebridge

Acelera migrações para Databricks automatizando atividades chave de migração

code-analysiscode-converterdata-validationdatabricks
Python108pushed 2mo ago
aehrc/VariantSpark147

VariantSpark

Aprendizado de máquina para variantes genômicas

association-studiesawsbioinformaticsdatabricks
JavaScript48pushed 2mo ago