Observabilidade na Cloudflare: correlacionar incidentes sem perder o controle da conta
Cloudflare aproxima logs e traces e muda a cobrança para volume. Avalie cobertura, amostragem e custos de ingestão, armazenamento e exportação.
A Cloudflare anunciou oito atualizações para aproximar logs, traces, analytics, alertas, dashboards e exportação numa plataforma comum.[12] Entre elas estão Cloudflare Traces em beta aberta e uma API SQL unificada também em beta.[12] O anúncio combina uma proposta de investigação mais integrada com uma mudança que exige revisão de orçamento.
O que muda para quem desenvolve
A nova área Logs reúne Workers Observability e Log Explorer, permite filtros, SQL e inspeção por Ray ID, mas consultas atravessando múltiplos datasets ainda são apresentadas como próximas.[12] Não confunda uma entrada comum na interface com correlação completa já disponível.
O tracing anunciado reúne decisões de segurança suportadas, cache, roteamento, Workers e origem, com amostragem, exportação OpenTelemetry e propagação de contexto W3C.[12] Minha análise é que o valor deve ser medido pela capacidade de explicar uma requisição problemática, não apenas pelo número de sinais coletados.
A cobrança de logs e traces passa de contagem de eventos para volume ingerido e armazenado a partir de 01/12/2026, com aplicação na renovação para clientes Enterprise.[12] Para aplicações com mensagens de tamanhos diferentes, recomendo revisar estimativas em bytes, não reutilizar diretamente o orçamento baseado em eventos.
Como aplicar
Faça uma investigação de ponta a ponta em homologação. Gere uma requisição identificável com dados sintéticos, provoque uma falha controlada na origem e registre o que é visível na borda, no Worker e no serviço final. Repita com cache e com uma decisão de segurança autorizada.
Documente quais etapas aparecem, quais ficam ausentes e quais dependem de amostragem. Depois transforme uma condição conhecida em alerta e verifique se a notificação oferece contexto suficiente para agir. Um dashboard bonito não substitui esse teste de diagnóstico.
Monte o orçamento em linhas separadas. Para planos pagos e Enterprise, o anúncio inclui 50 GB de ingestão e 10 GB-mês de armazenamento por ciclo, com excedentes de US$ 0,25 por GB ingerido e US$ 0,10 por GB-mês armazenado.[12] Logpush e Transformers têm franquias e cobranças próprias.[12] Calcule cada etapa com o volume observado da aplicação, sem assumir que ingestão paga cobre toda exportação.
Cuidados e limites
Retenção de até um ano e ampliação de APIs OpenTelemetry em Workers aparecem como capacidades futuras.[12] Não projete uma obrigação de retenção sobre uma função ainda anunciada.
Mais amostragem durante um incidente pode melhorar o diagnóstico e aumentar consumo. Menos retenção economiza, mas reduz a janela de investigação. Explicite esse trade-off e retire dados sensíveis antes de armazená-los quando possível. Para agentes operacionais, comece com consulta e sugestões: enxergar um trace não é motivo suficiente para conceder permissão de alterar produção.
Fonte
[12] Fonte: Cloudflare Blog