Pular para o conteúdo
← Todas as notícias
Databricks Blog5 de maio de 2026

10 trilhões de amostras por dia: Escalando além da infraestrutura de monitoramento tradicional na Databricks

Traduzido do original em inglês por IA. Ver em inglês

Resumo

A Databricks agora processa 10 trilhões de amostras diariamente, escalando além da infraestrutura de monitoramento tradicional ao reestruturar as camadas TSDB e de agregação com soluções de código aberto personalizadas. Uma nova plataforma baseada em Lakehouse, Hydra, oferece ricas capacidades de depuração para métricas de alta cardinalidade com armazenamento 50 vezes mais barato.

Os sistemas de monitoramento da Databricks gerenciam mais de 5 bilhões de séries temporais ativas em tempo real em AWS, Azure e GCP. Para manter esses sistemas confiáveis e de baixa manutenção, apesar do rápido dimensionamento, reestruturamos nossas camadas TSDB e de agregação, personalizando soluções de monitoramento de código aberto. Diante do grande crescimento em métricas de solução de problemas de alta cardinalidade, desenvolvemos uma nova plataforma baseada em Lakehouse chamada Hydra. Essa abordagem desbloqueou ricas capacidades de depuração em escala massiva e armazenamento 50 vezes mais barato do que nossa pilha existente.

Artigos relacionados

News

How Databricks Feature Store serves features with sub-second freshness

databricks-blog4h ago
News

The prototyping tax is killing your AI roadmap

databricks-blog7h ago
News

Usando AI_Functions no seu data warehouse: principais casos de uso

databricks-blog3d ago
News

Como a Scottish Water tornou seus dados de investimento de capital conversacionais com o Databricks Genie

databricks-blog4d ago