Pular para o conteúdo principal
Este guia fornece às equipes corporativas que estão avaliando o ClickHouse Cloud informações abrangentes sobre os recursos de monitoramento e observabilidade para implantações em produção. Clientes Enterprise frequentemente perguntam sobre recursos de monitoramento prontos para uso, a integração com stacks de observabilidade existentes, incluindo ferramentas como Datadog e AWS CloudWatch, e como o monitoramento do ClickHouse se compara ao de implantações autogerenciadas.

Painel avançado de observabilidade

O ClickHouse Cloud oferece monitoramento abrangente por meio de interfaces de painel integradas, acessíveis pela seção Monitoring. Esses painéis exibem métricas de sistema e desempenho em tempo real sem exigir configuração adicional e servem como as principais ferramentas de monitoramento de produção em tempo real no ClickHouse Cloud.
  • Advanced dashboard: A principal interface de painel, acessível em Monitoring → Advanced dashboard, oferece visibilidade em tempo real das taxas de consulta, do uso de recursos, da integridade do sistema e do desempenho de armazenamento. Esse painel não exige autenticação separada, não impede que instâncias fiquem ociosas e não adiciona carga de consultas ao seu sistema de produção. Cada visualização é baseada em consultas SQL personalizáveis, com gráficos prontos para uso agrupados em métricas específicas do ClickHouse, de integridade do sistema e específicas do Cloud. Você pode expandir o monitoramento criando consultas personalizadas diretamente no SQL Console.
O acesso a essas métricas não emite uma consulta para o serviço subjacente e não reativa serviços ociosos.
Os usuários que quiserem expandir essas visualizações podem usar o recurso de dashboards no ClickHouse Cloud, consultando tabelas de sistema diretamente.
  • Painel avançado nativo: Uma interface de painel alternativa acessível por meio de “You can still access the native advanced dashboard” na seção Monitoring. Ela é aberta em uma guia separada, com autenticação, e oferece uma UI alternativa para monitorar a integridade do sistema e do serviço. Esse painel permite análises avançadas, nas quais você pode modificar as consultas SQL subjacentes.
Ambos os painéis oferecem visibilidade imediata da integridade e do desempenho do serviço sem dependências externas, diferenciando-se de ferramentas externas voltadas para depuração, como o ClickStack. Para ver os recursos detalhados do painel e as métricas disponíveis, consulte a documentação do Advanced dashboard.

Query Insights e monitoramento de recursos

O ClickHouse Cloud inclui recursos adicionais de monitoramento:
  • Query Insights: Interface integrada para análise de desempenho de consultas e solução de problemas
  • Resource Utilization Dashboard: Acompanha padrões de uso de memória, alocação de CPU e transferência de dados. Os gráficos de uso de CPU e de memória mostram a métrica de utilização máxima em um determinado período. O gráfico de uso de CPU mostra uma métrica de utilização de CPU em nível de sistema (NÃO uma métrica de utilização de CPU do ClickHouse).
Consulte a documentação de Query Insights e utilização de recursos para ver os recursos em detalhes.

Endpoint de métricas compatível com Prometheus

O ClickHouse Cloud oferece um endpoint Prometheus. Isso permite manter os fluxos de trabalho atuais, aproveitar a experiência já existente da equipe e integrar métricas do ClickHouse a plataformas corporativas de monitoramento, incluindo Grafana, Datadog e outras ferramentas compatíveis com Prometheus. O endpoint em nível de organização federa métricas de todos os serviços, enquanto os endpoints por serviço oferecem monitoramento granular. Os principais recursos incluem:
  • Opção de métricas filtradas: o parâmetro opcional filtered_metrics=true reduz o payload de mais de 1000 métricas disponíveis para 125 métricas “essenciais”, otimizando custos e facilitando o foco no monitoramento
  • Entrega de métricas em cache: usa visões materializadas atualizadas a cada minuto para minimizar a carga de consultas nos sistemas de produção
Essa abordagem respeita o comportamento de inatividade do serviço, permitindo otimizar custos quando os serviços não estão processando consultas ativamente. Esse endpoint de API usa credenciais da ClickHouse Cloud API. Para ver os detalhes completos de configuração do endpoint, consulte a documentação do Prometheus do ClickHouse Cloud.

Exemplos de integração

A integração externa permite que as organizações mantenham fluxos de monitoramento já estabelecidos, aproveitem a experiência que as equipes já têm com ferramentas conhecidas e integrem o monitoramento do ClickHouse à observabilidade mais ampla da infraestrutura sem interromper os processos atuais nem exigir investimentos significativos em treinamento. As equipes podem aplicar às métricas do ClickHouse regras de alerta e procedimentos de escalonamento já existentes, ao mesmo tempo em que correlacionam o desempenho do banco de dados com a saúde da aplicação e da infraestrutura em uma plataforma unificada de observabilidade. Essa abordagem maximiza o ROI das configurações atuais de monitoramento e acelera a solução de problemas por meio de painéis consolidados e ferramentas já conhecidas.

Monitoramento do Grafana Cloud

O Grafana oferece monitoramento do ClickHouse tanto por meio de integração direta por plugin quanto de abordagens baseadas em Prometheus. A integração com o endpoint do Prometheus mantém a separação operacional entre o monitoramento e as cargas de trabalho de produção, ao mesmo tempo em que permite a visualização na infraestrutura existente do Grafana Cloud. Consulte a documentação do ClickHouse no Grafana para obter orientações de configuração.

Monitoramento do Datadog

A Datadog está desenvolvendo uma integração de API dedicada que fornecerá o monitoramento adequado do serviço em nuvem, respeitando o comportamento de inatividade do serviço. Enquanto isso, as equipes podem usar a abordagem de integração do OpenMetrics por meio dos endpoints Prometheus do ClickHouse para separação operacional e monitoramento com bom custo-benefício. Para orientações de configuração, consulte a documentação de integração do Prometheus e OpenMetrics da Datadog.

ClickStack

O ClickStack é a solução de observabilidade recomendada pelo ClickHouse para análise aprofundada e depuração do sistema, oferecendo uma plataforma unificada para logs, métricas e traces, usando o ClickHouse como mecanismo de armazenamento. Essa abordagem usa o HyperDX, a UI do ClickStack, que se conecta diretamente às tabelas de sistema na sua instância do ClickHouse. O HyperDX vem com um dashboard voltado para o ClickHouse, com abas para Selects, Inserts e Infrastructure. As equipes também podem usar sintaxe Lucene ou SQL para pesquisar nas tabelas de sistema e nos logs, além de criar visualizações personalizadas por meio do Chart Explorer para uma análise detalhada do sistema. Essa abordagem é ideal para depurar problemas complexos, analisar desempenho e fazer uma introspecção aprofundada do sistema, em vez de emitir alertas de produção em tempo real.
Observe que essa abordagem reativará serviços inativos, pois o HyperDX consulta diretamente as tabelas de sistema.

Opções de implantação do ClickStack

  • HyperDX no ClickHouse Cloud (private preview): o HyperDX pode ser executado em qualquer serviço do ClickHouse Cloud.
  • Helm: Recomendado para ambientes de depuração baseados em Kubernetes. Oferece suporte à integração com o ClickHouse Cloud e permite configurações específicas por ambiente, limites de recursos e escalonamento via values.yaml.
  • Docker Compose: Implanta cada componente (ClickHouse, HyperDX, OTel collector, MongoDB) individualmente. Você pode modificar o arquivo do Compose para remover componentes não utilizados ao integrar com o ClickHouse Cloud, especificamente o ClickHouse e o OpenTelemetry Collector.
  • Somente HyperDX: Contêiner HyperDX autônomo.
Para ver todas as opções de implantação e os detalhes da arquitetura, consulte a documentação do ClickStack e o guia de ingestão de dados.
Você também pode coletar métricas do endpoint Prometheus do ClickHouse Cloud por meio de um OpenTelemetry Collector e encaminhá-las para uma implantação separada do ClickStack para visualização.

Integração direta com o plugin do Grafana

O plugin de fonte de dados do ClickHouse para Grafana permite visualizar e explorar dados diretamente no ClickHouse usando tabelas de sistema. Essa abordagem funciona bem para monitorar o desempenho e criar dashboards personalizados para análises detalhadas do sistema. Para detalhes sobre a instalação e a configuração do plugin, consulte o plugin de fonte de dados do ClickHouse. Para uma configuração completa de monitoramento usando o mix-in Prometheus-Grafana com dashboards pré-configurados e regras de alerta, consulte Monitor ClickHouse with the new Prometheus-Grafana mix-in.

Integração direta com o Datadog

O Datadog oferece um plugin de monitoramento do ClickHouse para seu agente, que consulta tabelas de sistema diretamente. Essa integração fornece monitoramento abrangente do banco de dados com reconhecimento do cluster por meio da funcionalidade clusterAllReplicas.
Essa integração não é recomendada para implantações no ClickHouse Cloud devido à incompatibilidade com o comportamento de inatividade usado para otimizar custos e às limitações operacionais da camada de proxy da Cloud.

Usando tabelas de sistema diretamente

Você pode realizar uma análise aprofundada do desempenho de consultas conectando-se às tabelas de sistema do ClickHouse, especialmente à system.query_log, e consultando-as diretamente. Usando o Console SQL ou o clickhouse client, as equipes podem identificar consultas lentas, analisar o uso de recursos e acompanhar padrões de uso em toda a organização. Análise de desempenho de consultas Você pode usar os logs de consulta da tabela de sistema para realizar uma análise de desempenho de consultas. Consulta de exemplo: encontre as 5 consultas com maior tempo de execução em todas as réplicas do cluster:

Soluções de monitoramento da comunidade

A comunidade do ClickHouse desenvolveu soluções abrangentes de monitoramento que se integram a stacks populares de observabilidade. O ClickHouse Monitoring oferece uma configuração completa de monitoramento com dashboards pré-configurados. Este projeto open source oferece uma abordagem de início rápido para equipes que desejam implementar o monitoramento do ClickHouse com práticas recomendadas consolidadas e configurações de dashboard já validadas.
Assim como outras abordagens de monitoramento direto do banco de dados, esta solução consulta diretamente as tabelas de sistema do ClickHouse, o que impede que as instâncias fiquem ociosas e afeta a otimização de custos.

Considerações sobre o impacto no sistema

Todas as abordagens acima combinam o uso de endpoints do Prometheus, o gerenciamento pelo ClickHouse Cloud ou a consulta direta às tabelas de sistema. A última dessas opções depende da execução de consultas no serviço ClickHouse de produção. Isso adiciona carga de consultas ao sistema monitorado e impede que instâncias do ClickHouse Cloud entrem em estado ocioso, prejudicando a otimização de custos. Além disso, se o sistema de produção falhar, o monitoramento também poderá ser afetado, já que os dois estão acoplados. Essa abordagem funciona bem para introspecção profunda e depuração, mas é menos adequada para monitoramento de produção em tempo real. Considere essas compensações entre a capacidade de análise detalhada do sistema e a sobrecarga operacional ao avaliar a integração direta com o Grafana em comparação com as abordagens de integração com ferramentas externas discutidas na seção a seguir.
Última modificação em 25 de junho de 2026