{"id":34537,"date":"2026-08-25T02:32:38","date_gmt":"2026-08-25T02:32:38","guid":{"rendered":"https:\/\/www.dotcom-monitor.com\/blog\/cloud-infrastructure-monitoring\/"},"modified":"2026-08-27T00:35:00","modified_gmt":"2026-08-27T00:35:00","slug":"monitoramento-de-infraestrutura-em-nuvem","status":"publish","type":"post","link":"https:\/\/www.dotcom-monitor.com\/blog\/pt-br\/monitoramento-de-infraestrutura-em-nuvem\/","title":{"rendered":"Monitoramento de Infraestrutura em Nuvem: O Que Seu Provedor N\u00e3o Vai Te Contar"},"content":{"rendered":"<figure id=\"attachment_34519\" aria-describedby=\"caption-attachment-34519\" style=\"width: 1200px\" class=\"wp-caption alignnone\"><img fetchpriority=\"high\" decoding=\"async\" class=\"size-full wp-image-34519\" src=\"https:\/\/www.dotcom-monitor.com\/blog\/wp-content\/uploads\/sites\/3\/2026\/08\/hero-cloud-infrastructure-monitoring.webp\" alt=\"Network operations center with an all-green cloud infrastructure dashboard beside a red external monitoring alert showing failing check locations worldwide\" width=\"1200\" height=\"800\" srcset=\"https:\/\/www.dotcom-monitor.com\/blog\/wp-content\/uploads\/sites\/3\/2026\/08\/hero-cloud-infrastructure-monitoring.webp 1200w, https:\/\/www.dotcom-monitor.com\/blog\/wp-content\/uploads\/sites\/3\/2026\/08\/hero-cloud-infrastructure-monitoring-300x200.webp 300w, https:\/\/www.dotcom-monitor.com\/blog\/wp-content\/uploads\/sites\/3\/2026\/08\/hero-cloud-infrastructure-monitoring-1024x683.webp 1024w, https:\/\/www.dotcom-monitor.com\/blog\/wp-content\/uploads\/sites\/3\/2026\/08\/hero-cloud-infrastructure-monitoring-768x512.webp 768w\" sizes=\"(max-width: 1200px) 100vw, 1200px\" \/><figcaption id=\"caption-attachment-34519\" class=\"wp-caption-text\">Um guia do comprador para gestores de TI avaliando ferramentas de monitoramento em nuvem<\/figcaption><\/figure>\n<p>Seu console em nuvem est\u00e1 verde. Seus alertas est\u00e3o silenciosos. E a fila de suporte est\u00e1 enchendo com clientes que n\u00e3o conseguem fazer login.<\/p>\n<p>Essa combina\u00e7\u00e3o \u00e9 mais comum do que a maioria das equipes admite, e geralmente n\u00e3o se trata de uma configura\u00e7\u00e3o incorreta. O monitoramento nativo na nuvem roda dentro da mesma infraestrutura que monitora \u2014 ent\u00e3o, quando essa infraestrutura tem um dia ruim, sua pr\u00f3pria telemetria \u00e9 o \u00faltimo lugar para buscar uma resposta independente.<\/p>\n<p>Se voc\u00ea est\u00e1 comparando ferramentas de monitoramento de infraestrutura em nuvem agora, essa lacuna deve guiar sua lista de finalistas mais do que qualquer matriz de funcionalidades. Abaixo: o que o monitoramento do seu provedor pode e n\u00e3o pode ver, como testar um fornecedor contra as falhas que voc\u00ea realmente tem, e quais termos de pre\u00e7o surpreendem as equipes cerca de seis meses depois.<\/p>\n<h2 id='o-que-este-guia-cont\u00e9m'  id=\"boomdevs_1\">O Que Este Guia Cont\u00e9m<\/h2>\n<ul>\n<li><a href=\"#por-que-o-monitoramento-do-seu-provedor-de-nuvem-n\u00e3o-consegue-ver-a-queda\">Por que o monitoramento do seu provedor de nuvem n\u00e3o consegue ver a queda<\/a><\/li>\n<li><a href=\"#o-que-o-monitoramento-nativo-na-nuvem-realmente-mede\">O que o monitoramento nativo na nuvem realmente mede<\/a><\/li>\n<li><a href=\"#tr\u00eas-falhas-que-aparecem-verdes-em-um-painel-de-nuvem\">Tr\u00eas falhas que aparecem verdes em um painel de nuvem<\/a><\/li>\n<li><a href=\"#como-avaliar-uma-ferramenta-de-monitoramento-de-infraestrutura-em-nuvem\">Como avaliar uma ferramenta de monitoramento de infraestrutura em nuvem<\/a><\/li>\n<li><a href=\"#quais-m\u00e9tricas-devem-estar-no-seu-teste-da-lista-de-finalistas\">Quais m\u00e9tricas devem estar no seu teste da lista de finalistas<\/a><\/li>\n<li><a href=\"#onde-a-precifica\u00e7\u00e3o-de-monitoramento-em-nuvem-surpreende-as-equipes\">Onde a precifica\u00e7\u00e3o de monitoramento em nuvem surpreende as equipes<\/a><\/li>\n<li><a href=\"#perguntas-para-fazer-em-todas-as-liga\u00e7\u00f5es-com-fornecedores\">Perguntas para fazer em todas as liga\u00e7\u00f5es com fornecedores<\/a><\/li>\n<li><a href=\"#a-conclus\u00e3o-sobre-monitoramento-de-infraestrutura-em-nuvem\">A conclus\u00e3o sobre monitoramento de infraestrutura em nuvem<\/a><\/li>\n<li><a href=\"#heading-faq\">Perguntas frequentes<\/a><\/li>\n<\/ul>\n<h2 id='por-que-o-monitoramento-do-seu-provedor-de-nuvem-n\u00e3o-consegue-ver-a-queda'  id=\"boomdevs_2\" id=\"why-your-cloud-provider-s-monitoring-can-t-see-the-outage\">Por Que o Monitoramento do Seu Provedor de Nuvem N\u00e3o Consegue Ver a Queda<\/h2>\n<p>Todo sistema de monitoramento tem um ponto de vista. O ponto de vista do seu provedor est\u00e1 dentro da pr\u00f3pria rede dele.<\/p>\n<p>Uma defini\u00e7\u00e3o primeiro, porque isso decide o resto do argumento. Monitoramento nativo na nuvem aqui significa as m\u00e9tricas e alarmes de recursos padr\u00e3o que voc\u00ea obt\u00e9m com a plataforma \u2014 Amazon CloudWatch, Azure Monitor, Google Cloud Monitoring \u2014 n\u00e3o todas as funcionalidades de disponibilidade que o provedor vende junto.<\/p>\n<p>Esses padr\u00f5es s\u00e3o \u00fateis. CloudWatch vai dizer que uma inst\u00e2ncia est\u00e1 com CPU em 100%, que um grupo de Auto Scaling adicionou capacidade, que as conex\u00f5es de banco de dados est\u00e3o esgotadas. Sinais reais, e voc\u00ea deve continuar coletando-os.<\/p>\n<p>Mas a verifica\u00e7\u00e3o \u00e9 executada no plano de controle do provedor, pela rede do provedor, contra a API do provedor. Se o plano de controle degrada, o pipeline de m\u00e9tricas degrada junto. E m\u00e9tricas atrasadas parecem exatamente como m\u00e9tricas saud\u00e1veis num painel: nenhum alarme dispara, porque nenhum dado chegou que acionaria um.<\/p>\n<p>O segundo limite importa mais para qualquer coisa voltada ao cliente. Essas m\u00e9tricas padr\u00e3o medem seus recursos, n\u00e3o o caminho entre um usu\u00e1rio em S\u00e3o Paulo e seu balanceador de carga em us-east-1. Resolu\u00e7\u00e3o DNS, roteamento BGP, comportamento de borda CDN, negocia\u00e7\u00e3o TLS, scripts de terceiros, regras WAF \u2014 tudo isso est\u00e1 fora dessa fronteira, e qualquer um pode derrubar seu servi\u00e7o enquanto CPU e mem\u00f3ria permanecem est\u00e1veis.<\/p>\n<blockquote><p>Um sistema de monitoramento que vive dentro do dom\u00ednio de falha \u00e9 o \u00faltimo a avisar que esse dom\u00ednio est\u00e1 quebrado.<\/p><\/blockquote>\n<h3 id='mas-o-cloudwatch-synthetics-j\u00e1-n\u00e3o-faz-isso'  id=\"boomdevs_3\" id=\"but-doesn-t-cloudwatch-synthetics-already-do-this\">Mas o CloudWatch Synthetics J\u00e1 N\u00e3o Faz Isso?<\/h3>\n<p>Parcialmente, e essa obje\u00e7\u00e3o merece ser levada a s\u00e9rio. Todo provedor importante vende algo aqui: can\u00e1rios do CloudWatch Synthetics, verifica\u00e7\u00f5es de sa\u00fade do Route 53, testes de disponibilidade do Azure Monitor, verifica\u00e7\u00f5es de uptime do Google Cloud. Eles executam requisi\u00e7\u00f5es reais contra seus endpoints e funcionam.<\/p>\n<p>O problema \u00e9 onde eles executam. Essas verifica\u00e7\u00f5es rodam na mesma infraestrutura do provedor e postam resultados no mesmo console, a cobertura fora das regi\u00f5es do provedor \u00e9 fina, e um grande evento regional pode atingir as verifica\u00e7\u00f5es e a carga ao mesmo tempo. Ferramentas \u00fateis \u2014 mas n\u00e3o independentes.<\/p>\n<p>Independ\u00eancia \u00e9 o verdadeiro requisito, e \u00e9 justo devolver essa pergunta a qualquer fornecedor. Muitos servi\u00e7os de monitoramento de terceiros tamb\u00e9m rodam em uma grande nuvem. Ent\u00e3o pergunte onde ficam as localidades das verifica\u00e7\u00f5es: uma rede que abrange m\u00faltiplos provedores e n\u00f3s operados por operadoras, ou tr\u00eas regi\u00f5es alugadas da nuvem que voc\u00ea j\u00e1 usa. Dotcom-Monitor opera sua pr\u00f3pria <a href=\"https:\/\/www.dotcom-monitor.com\/pt-br\/caracteristicas\/recursos-monitoramento-de-rede\/\">rede global de monitoramento<\/a> em vez de alugar regi\u00f5es, o que torna a verifica\u00e7\u00e3o significativa.<\/p>\n<p>Voc\u00ea pode construir uma vers\u00e3o disso. Prometheus Blackbox Exporter sondas endpoints, e para um ou dois pontos de vista isso \u00e9 uma resposta razo\u00e1vel. O custo aparece quando voc\u00ea precisa de dezenas de geografias, renderiza\u00e7\u00e3o real em navegador, e algu\u00e9m de plant\u00e3o para as pr\u00f3prias sondas.<\/p>\n<p>De qualquer forma, execute a verifica\u00e7\u00e3o fora do sistema que est\u00e1 verificando. <a href=\"https:\/\/www.dotcom-monitor.com\/pt-br\/solucoes\/synthetic-monitoring\/\">Monitoramento sint\u00e9tico<\/a> envia requisi\u00e7\u00f5es pela internet p\u00fablica num hor\u00e1rio que voc\u00ea define. Se uma falhar, voc\u00ea ouve isso pela verifica\u00e7\u00e3o e n\u00e3o por um cliente.<\/p>\n<h2 id='o-que-o-monitoramento-nativo-na-nuvem-realmente-mede'  id=\"boomdevs_4\" id=\"what-cloud-native-monitoring-actually-measures\">O Que o Monitoramento Nativo na Nuvem Realmente Mede<\/h2>\n<p>Aqui est\u00e1 a divis\u00e3o, camada por camada. Mapeie sua cobertura atual contra isso antes de falar com qualquer fornecedor.<\/p>\n<div class=\"table-wrap\">\n<table>\n<thead>\n<tr>\n<th>Camada<\/th>\n<th>M\u00e9tricas Padr\u00e3o da Nuvem<\/th>\n<th>Verifica\u00e7\u00f5es Externas Independentes<\/th>\n<\/tr>\n<\/thead>\n<tbody>\n<tr>\n<td>CPU, mem\u00f3ria, disco em suas inst\u00e2ncias<\/td>\n<td>Sim, e em detalhe<\/td>\n<td>N\u00e3o<\/td>\n<\/tr>\n<tr>\n<td>Sa\u00fade de banco de dados gerenciado e filas<\/td>\n<td>Sim<\/td>\n<td>Indiretamente, via comportamento do app<\/td>\n<\/tr>\n<tr>\n<td>Eventos de autoscaling e implanta\u00e7\u00e3o<\/td>\n<td>Sim<\/td>\n<td>N\u00e3o<\/td>\n<\/tr>\n<tr>\n<td>Resolu\u00e7\u00e3o DNS p\u00fablica<\/td>\n<td>Parcial, dentro da VPC<\/td>\n<td>Sim, de resolvedores reais no mundo<\/td>\n<\/tr>\n<tr>\n<td>Validade do certificado TLS na borda<\/td>\n<td>Parcial<\/td>\n<td>Sim<\/td>\n<\/tr>\n<tr>\n<td>Caminho de rede e roteamento aos usu\u00e1rios<\/td>\n<td>N\u00e3o<\/td>\n<td>Sim<\/td>\n<\/tr>\n<tr>\n<td>Comportamento de CDN e cache de borda<\/td>\n<td>N\u00e3o<\/td>\n<td>Sim<\/td>\n<\/tr>\n<tr>\n<td>Jornada completa de login ou checkout<\/td>\n<td>N\u00e3o<\/td>\n<td>Sim<\/td>\n<\/tr>\n<tr>\n<td>Falhas de API e scripts de terceiros<\/td>\n<td>N\u00e3o<\/td>\n<td>Sim<\/td>\n<\/tr>\n<\/tbody>\n<\/table>\n<\/div>\n<p>Nenhuma coluna substitui a outra. As ferramentas do seu provedor s\u00e3o o melhor instrumento para diagn\u00f3stico de causa raiz, uma vez que voc\u00ea sabe algo est\u00e1 errado. Verifica\u00e7\u00f5es externas s\u00e3o o que informam que algo est\u00e1 errado em primeiro lugar\u2014e continuam reportando quando o pipeline do provedor para. Nosso post sobre <a href=\"https:\/\/www.dotcom-monitor.com\/blog\/pt-br\/what-is-infrastructure-monitoring\/\">o que o monitoramento de infraestrutura cobre<\/a> aprofunda o lado de n\u00edvel de recurso.<\/p>\n<p>Use ambos. Reserve or\u00e7amento para ambos.<\/p>\n<figure id=\"attachment_34526\" aria-describedby=\"caption-attachment-34526\" style=\"width: 1200px\" class=\"wp-caption alignnone\"><img decoding=\"async\" class=\"size-full wp-image-34526\" src=\"https:\/\/www.dotcom-monitor.com\/blog\/wp-content\/uploads\/sites\/3\/2026\/08\/inside-vs-outside-failure-domain.webp\" alt=\"Diagram comparing cloud-native monitoring inside the provider network with external synthetic checks running from outside it\" width=\"1200\" height=\"530\" srcset=\"https:\/\/www.dotcom-monitor.com\/blog\/wp-content\/uploads\/sites\/3\/2026\/08\/inside-vs-outside-failure-domain.webp 1200w, https:\/\/www.dotcom-monitor.com\/blog\/wp-content\/uploads\/sites\/3\/2026\/08\/inside-vs-outside-failure-domain-300x133.webp 300w, https:\/\/www.dotcom-monitor.com\/blog\/wp-content\/uploads\/sites\/3\/2026\/08\/inside-vs-outside-failure-domain-1024x452.webp 1024w, https:\/\/www.dotcom-monitor.com\/blog\/wp-content\/uploads\/sites\/3\/2026\/08\/inside-vs-outside-failure-domain-768x339.webp 768w\" sizes=\"(max-width: 1200px) 100vw, 1200px\" \/><figcaption id=\"caption-attachment-34526\" class=\"wp-caption-text\">Agentes nativos na nuvem reportam de dentro da rede do provedor. Verifica\u00e7\u00f5es externas fazem a mesma requisi\u00e7\u00e3o que um cliente faria.<\/figcaption><\/figure>\n<h2 id='tr\u00eas-falhas-que-aparecem-verdes-em-um-painel-de-nuvem'  id=\"boomdevs_5\" id=\"three-failures-that-show-up-green-on-a-cloud-dashboard\">Tr\u00eas Falhas Que Aparecem Verdes em um Painel de Nuvem<\/h2>\n<p>S\u00e3o padr\u00f5es, n\u00e3o estudos de caso. Rode cargas de produ\u00e7\u00e3o na AWS, Azure ou Google Cloud por alguns anos e pelo menos uma soar\u00e1 familiar.<\/p>\n<h3 id='um-registro-dns-que-quebrou-para-metade-dos-seus-usu\u00e1rios'  id=\"boomdevs_6\" id=\"a-dns-record-that-broke-for-half-your-users\">Um Registro DNS Que Quebrou para Metade dos Seus Usu\u00e1rios<\/h3>\n<p>Algu\u00e9m atualiza um registro durante uma migra\u00e7\u00e3o. A altera\u00e7\u00e3o est\u00e1 correta no nameserver autoritativo, ent\u00e3o toda verifica\u00e7\u00e3o interna passa. Mas o endpoint antigo foi descomissionado antes do TTL anterior expirar, ent\u00e3o resolvedores recursivos ao redor do mundo continuam entregando o endere\u00e7o antigo at\u00e9 que a c\u00f3pia em cache expire. Um peda\u00e7o do seu tr\u00e1fego continua batendo em algo que n\u00e3o responde mais.<\/p>\n<p>Suas inst\u00e2ncias est\u00e3o saud\u00e1veis. Seu balanceador de carga v\u00ea menos tr\u00e1fego e n\u00e3o reporta nada incomum. Capturar isso significa resolver o nome de fora, de v\u00e1rias geografias, do jeito que um cliente real faria. \u00c9 o que <a href=\"https:\/\/www.dotcom-monitor.com\/pt-br\/produtos-de-monitoramento\/ferramenta-de-monitorizacao-de-dns-dotcom-monitor\/\">monitoramento DNS<\/a> faz, e \u00e9 por isso que a localiza\u00e7\u00e3o dos resolvedores importa numa avalia\u00e7\u00e3o.<\/p>\n<h3 id='um-certificado-que-expirou-em-um-balanceador-de-carga'  id=\"boomdevs_7\" id=\"a-certificate-that-expired-on-a-load-balancer\">Um Certificado Que Expirou em um Balanceador de Carga<\/h3>\n<p>A renova\u00e7\u00e3o \u00e9 automatizada hoje, e \u00e9 exatamente por isso que falha silenciosamente. Um job quebra, ningu\u00e9m percebe, e o certificado em um ouvinte ou uma propriedade CDN na borda expira.<\/p>\n<p>As inst\u00e2ncias atr\u00e1s dele est\u00e3o boas. CPU est\u00e1 boa. Logs da aplica\u00e7\u00e3o mostram queda nas requisi\u00e7\u00f5es, n\u00e3o erro. Navegadores, enquanto isso, exibem um aviso intersticial para cada visitante. <a href=\"https:\/\/www.dotcom-monitor.com\/pt-br\/produtos-de-monitoramento\/ssl-certificate-monitoring\/\">Monitoramento de certificado SSL<\/a> que verifica a cadeia de fora detecta isso semanas antes.<\/p>\n<h3 id='uma-regi\u00e3o-marcada-como-operando-normalmente'  id=\"boomdevs_8\" id=\"a-region-marked-operating-normally\">Uma Regi\u00e3o Marcada Como Operando Normalmente<\/h3>\n<p>As p\u00e1ginas de status do provedor geralmente esperam confirma\u00e7\u00e3o interna antes de mudar de cor. Isso \u00e9 razo\u00e1vel para evitar falsos alarmes entre milh\u00f5es de clientes, e tamb\u00e9m significa que a p\u00e1gina tende a atrasar o incidente. Equipes rotineiramente veem erros antes que o painel fique amarelo.<\/p>\n<p>Se sua resposta a incidentes espera a p\u00e1gina de status, voc\u00ea passou o tempo de detec\u00e7\u00e3o para o processo de revis\u00e3o de outra pessoa. Verifica\u00e7\u00f5es independentes te d\u00e3o sua pr\u00f3pria linha do tempo \u2014 durante o incidente e depois, quando voc\u00ea faz a reconcilia\u00e7\u00e3o contra um SLA. Esses s\u00e3o os dados que tornam <a href=\"https:\/\/www.dotcom-monitor.com\/pt-br\/caracteristicas\/uptime-and-sla-reports\/\">relat\u00f3rios de uptime e SLA<\/a> valiosos em disputas de cr\u00e9dito.<\/p>\n<h2 id='como-avaliar-uma-ferramenta-de-monitoramento-de-infraestrutura-em-nuvem'  id=\"boomdevs_9\" id=\"how-to-evaluate-a-cloud-infrastructure-monitoring-tool\">Como Avaliar uma Ferramenta de Monitoramento de Infraestrutura em Nuvem<\/h2>\n<p>A maioria das compara\u00e7\u00f5es de fornecedores classifica funcionalidades. Isso diz muito pouco \u2014 as listas de funcionalidades convergiram, e metade delas descreve a mesma capacidade com marcas diferentes. Teste contra suas pr\u00f3prias falhas em vez disso.<\/p>\n<p><strong>Passo 1: Anote os \u00faltimos cinco incidentes que voc\u00ea realmente teve.<\/strong> Tire-os do seu sistema de tickets, n\u00e3o da mem\u00f3ria, e anote como voc\u00ea soube de cada um. Se mais de um veio de um cliente, voc\u00ea tem um problema de detec\u00e7\u00e3o, n\u00e3o de painel.<\/p>\n<p><strong>Passo 2: Verifique onde o fornecedor executa suas verifica\u00e7\u00f5es.<\/strong> Pe\u00e7a a lista de localidades, n\u00e3o apenas um n\u00famero, e pergunte quem \u00e9 o dono dessas localidades. Trinta localidades agrupadas na Am\u00e9rica do Norte e Europa Ocidental n\u00e3o dizem nada sobre usu\u00e1rios no Sudeste Asi\u00e1tico. Locais alugados da nuvem que voc\u00ea j\u00e1 usa n\u00e3o dizem nada durante um evento regional.<\/p>\n<p><strong>Passo 3: Teste uma jornada multi-etapa, n\u00e3o um ping na homepage.<\/strong> Um 200 no URL raiz prova quase nada. Scripts de login, busca, adicionar ao carrinho, uma chamada API autenticada com uma credencial de teste espec\u00edfica. Verifica\u00e7\u00f5es de c\u00f3digo de status passam em todo teste e ainda perdem a queda que te custa dinheiro. A scriptagem <a href=\"https:\/\/www.dotcom-monitor.com\/pt-br\/caracteristicas\/everystep\/\">EveryStep<\/a> lida com o caso de jornada gravada.<\/p>\n<p><strong>Passo 4: Quebre algo de prop\u00f3sito durante o trial.<\/strong> Aponte uma verifica\u00e7\u00e3o para um hostname de staging que voc\u00ea controla, depois retire o registro DNS ou retorne um 500 forte. Cronometre o alerta e leia o que ele diz. Essa ser\u00e1 a hora mais \u00fatil do seu trial.<\/p>\n<p><strong>Passo 5: Leia o alerta como se ele te acordasse.<\/strong> Ele nomeia a etapa que falhou, a localiza\u00e7\u00e3o, a classe do erro, o tempo de resposta? Ou diz s\u00f3 &#8220;site down&#8221;? Essa diferen\u00e7a decide se seu engenheiro de plant\u00e3o come\u00e7a a consertar \u00e0s 2:04 am ou come\u00e7a a investigar. Veja como o <a href=\"https:\/\/www.dotcom-monitor.com\/pt-br\/caracteristicas\/recursos-alertas\/\">alerta<\/a> se integra ao que voc\u00ea j\u00e1 usa \u2014 PagerDuty, Slack, Teams, webhook.<\/p>\n<p><strong>Passo 6: Confirme que ele chega aos seus sistemas internos tamb\u00e9m.<\/strong> Muito do que voc\u00ea roda n\u00e3o \u00e9 p\u00fablico: pain\u00e9is administrativos, APIs internas, staging, qualquer coisa atr\u00e1s de VPN. Ferramenta que s\u00f3 v\u00ea internet aberta te deixa comprando uma segunda. <a href=\"https:\/\/www.dotcom-monitor.com\/pt-br\/caracteristicas\/caracteristicas-agentes-privados\/\">Agentes privados<\/a> fazem verifica\u00e7\u00f5es de dentro da sua rede e reportam no mesmo console.<\/p>\n<p><strong>Passo 7: Modele a conta na escala do pr\u00f3ximo ano.<\/strong> Dobre seu n\u00famero atual de verifica\u00e7\u00f5es, aplique o intervalo que voc\u00ea realmente quer, e pe\u00e7a esse n\u00famero por escrito.<\/p>\n<h2 id='quais-m\u00e9tricas-devem-estar-no-seu-teste-da-lista-de-finalistas'  id=\"boomdevs_10\" id=\"which-metrics-belong-in-your-shortlist-test\">Quais M\u00e9tricas Devem Estar no Seu Teste da Lista de Finalistas<\/h2>\n<p>Percentual de disponibilidade acaba no deck da diretoria, e \u00e9 o n\u00famero menos \u00fatil durante uma avalia\u00e7\u00e3o \u2014 n\u00fameros de uptime arredondam precisamente as falhas que voc\u00ea se importa. Pe\u00e7a estas em vez disso:<\/p>\n<ul>\n<li><strong>Tempo para detectar.<\/strong> Minutos entre o in\u00edcio da falha e a chegada do alerta. Esse \u00e9 o n\u00famero que justifica a compra.<\/li>\n<li><strong>Tempo de resposta por localiza\u00e7\u00e3o.<\/strong> Um p95 por regi\u00e3o, n\u00e3o uma m\u00e9dia global que esconde seus mercados lentos.<\/li>\n<li><strong>Detalhamento de erro por camada.<\/strong> DNS, TCP, TLS, HTTP, assertiva de conte\u00fado. Ferramenta que reporta &#8220;falhou&#8221; sem nomear a camada devolveu a depura\u00e7\u00e3o para voc\u00ea.<\/li>\n<li><strong>Comportamento de confirma\u00e7\u00e3o de falha.<\/strong> Quantas localidades devem concordar para disparar alerta, e qu\u00e3o r\u00e1pido. Muito aberto gera ru\u00eddo; muito rigoroso gera atraso.<\/li>\n<li><strong>Reten\u00e7\u00e3o de dados de checagem bruta.<\/strong> Resumos s\u00e3o bons para relat\u00f3rios. Revis\u00e3o p\u00f3s-incidente precisa das checagens individuais.<\/li>\n<\/ul>\n<p>Backends distribu\u00eddos complicam isso \u2014 depend\u00eancias falham parcialmente e sintomas se movem. Nosso guia sobre <a href=\"https:\/\/www.dotcom-monitor.com\/blog\/pt-br\/monitoramento-de-sistemas-distribuidos\/\">monitoramento de sistemas distribu\u00eddos<\/a> cobre esse caso.<\/p>\n<h2 id='onde-a-precifica\u00e7\u00e3o-de-monitoramento-em-nuvem-surpreende-as-equipes'  id=\"boomdevs_11\" id=\"where-cloud-monitoring-pricing-catches-teams-out\">Onde a Precifica\u00e7\u00e3o de Monitoramento em Nuvem Surpreende as Equipes<\/h2>\n<p>Contas de monitoramento tendem a crescer mais r\u00e1pido que a infraestrutura que monitoram. Onde isso acontece:<\/p>\n<p><strong>Pre\u00e7o por host em ambiente de autoscaling.<\/strong> Se voc\u00ea \u00e9 cobrado por host monitorado e sua frota escala com o tr\u00e1fego, a conta escala junto. Pergunte como inst\u00e2ncias ef\u00eameras s\u00e3o contabilizadas e por qual janela.<\/p>\n<p><strong>M\u00e9tricas customizadas e tags de alta cardinalidade.<\/strong> Monitoramento nativo na nuvem frequentemente cobra por m\u00e9trica customizada por m\u00eas. Adicione uma tag de alta cardinalidade \u2014 ID de cliente, ID de container \u2014 e a contagem multiplica sem ningu\u00e9m decidir gastar mais.<\/p>\n<p><strong>Ingest\u00e3o, reten\u00e7\u00e3o, assentos e SMS.<\/strong> Volume de logs raramente diminui, ent\u00e3o verifique o que acontece em cada limite de tier e se reten\u00e7\u00e3o tem pre\u00e7o separado da ingest\u00e3o. Algumas plataformas tamb\u00e9m cobram por usu\u00e1rio, o que transforma &#8220;dar acesso de leitura ao suporte&#8221; em conversa de or\u00e7amento, e medem SMS e alertas de voz separadamente.<\/p>\n<p><strong>Frequ\u00eancia de checagem.<\/strong> Em fornecedores que cobram por execu\u00e7\u00e3o, ir de intervalo de cinco minutos para um minuto multiplica o custo dessa checagem por cinco. Outros agrupam execu\u00e7\u00f5es ou limitam a frequ\u00eancia pelo n\u00edvel do plano, ent\u00e3o o formato varia \u2014 mas raramente \u00e9 de gra\u00e7a, e decide se voc\u00ea pega uma queda curta ou perde ela. Pre\u00e7o pela frequ\u00eancia que voc\u00ea vai realmente rodar, por servi\u00e7o. O <a href=\"https:\/\/www.dotcom-monitor.com\/pt-br\/precificacao\/\">pre\u00e7o<\/a> do Dotcom-Monitor funciona por verifica\u00e7\u00e3o e por intervalo, ent\u00e3o essa conta \u00e9 f\u00e1cil de fazer \u00e0 frente.<\/p>\n<p>Compare o total com o <a href=\"https:\/\/www.dotcom-monitor.com\/blog\/pt-br\/qual-e-o-custo-do-tempo-de-inatividade\/\">custo do downtime<\/a> para seu pr\u00f3prio servi\u00e7o. Para a maioria das equipes, o custo de monitoramento \u00e9 pequeno comparado a uma \u00fanica hora ruim \u2014 mas tenha essa compara\u00e7\u00e3o por escrito antes da conversa de renova\u00e7\u00e3o.<\/p>\n<h2 id='perguntas-para-fazer-em-todas-as-liga\u00e7\u00f5es-com-fornecedores'  id=\"boomdevs_12\" id=\"questions-to-ask-on-every-vendor-call\">Perguntas para Fazer em Todas as Liga\u00e7\u00f5es com Fornecedores<\/h2>\n<p>Leve estas para a demonstra\u00e7\u00e3o. As respostas separam ferramentas rapidamente:<\/p>\n<ul>\n<li>Quem \u00e9 o dono das localidades das suas verifica\u00e7\u00f5es \u2014 seus pr\u00f3prios n\u00f3s, instala\u00e7\u00f5es de operadoras ou regi\u00f5es alugadas da AWS, Azure ou Google Cloud?<\/li>\n<li>A verifica\u00e7\u00e3o usa um navegador real ou um cliente HTTP, e o que isso muda no que ela captura?<\/li>\n<li>Como voc\u00ea monitora um endpoint que requer OAuth ou SSO?<\/li>\n<li>Quantas localidades t\u00eam que falhar para disparar alerta, e isso \u00e9 ajust\u00e1vel?<\/li>\n<li>Por quanto tempo voc\u00ea mant\u00e9m resultados brutos das verifica\u00e7\u00f5es, e posso export\u00e1-los?<\/li>\n<li>Como fica a conta se eu dobrar minhas verifica\u00e7\u00f5es e reduzir pela metade o intervalo?<\/li>\n<\/ul>\n<p>Para o processo de sele\u00e7\u00e3o mais amplo \u2014 estabilidade do fornecedor, suporte, termos contratuais \u2014 escrevemos isso separadamente em nossas <a href=\"https:\/\/www.dotcom-monitor.com\/blog\/pt-br\/diretrizes-para-escolher-uma-plataforma-de-monitoramento\/\">diretrizes para escolher uma plataforma de monitoramento<\/a>.<\/p>\n<h2 id='a-conclus\u00e3o-sobre-monitoramento-de-infraestrutura-em-nuvem'  id=\"boomdevs_13\" id=\"the-bottom-line-on-cloud-infrastructure-monitoring\">A Conclus\u00e3o Sobre Monitoramento de Infraestrutura em Nuvem<\/h2>\n<p>Mantenha o monitoramento do seu provedor. \u00c9 o melhor instrumento que voc\u00ea tem para diagn\u00f3stico em n\u00edvel de recurso, j\u00e1 est\u00e1 implantado, e as m\u00e9tricas b\u00e1sicas acompanham o compute. Cuidado com a conta de m\u00e9tricas customizadas, logs e reten\u00e7\u00e3o, mas mantenha.<\/p>\n<p>S\u00f3 n\u00e3o fa\u00e7a dele seu detector de quedas. Ele reporta de dentro do sistema que monitora, e as m\u00e9tricas padr\u00e3o n\u00e3o conseguem ver o caminho de rede, a resolu\u00e7\u00e3o DNS p\u00fablica, o certificado de borda ou o fluxo de login do qual seus clientes dependem. Essas s\u00e3o as falhas que chegam primeiro na sua fila de suporte.<\/p>\n<p>A avalia\u00e7\u00e3o que funciona \u00e9 curta: liste seus incidentes reais, teste candidatos contra essas falhas, quebre algo durante o trial, precifique a configura\u00e7\u00e3o que voc\u00ea realmente vai usar. Uma ferramenta que teria detectado suas \u00faltimas cinco quedas cinco minutos antes j\u00e1 valeu o investimento.<\/p>\n<section class=\"final-cta\">\n<h2 id='veja-o-que-verifica\u00e7\u00f5es-externas-detectam'  id=\"boomdevs_14\">Veja o Que Verifica\u00e7\u00f5es Externas Detectam<\/h2>\n<p>Dotcom-Monitor executa verifica\u00e7\u00f5es de navegador real e por protocolo contra sua infraestrutura em nuvem a partir de uma rede global de localidades, al\u00e9m de agentes privados para qualquer coisa atr\u00e1s do seu firewall. Inicie um teste gratuito e aponte uma verifica\u00e7\u00e3o para o servi\u00e7o sobre o qual voc\u00ea tem menos certeza.<\/p>\n<p><a href=\"https:\/\/www.dotcom-monitor.com\/pt-br\/solucoes\/monitoramento-infraestrutura\/\">Explore monitoramento de infraestrutura<\/a> ou <a href=\"https:\/\/www.dotcom-monitor.com\/pt-br\/produtos-de-monitoramento\/monitoramento-de-aplicativos-web\/\">monitoramento de aplica\u00e7\u00e3o web<\/a>.<\/p>\n<\/section>\n","protected":false},"excerpt":{"rendered":"<p>O monitoramento do seu provedor de nuvem roda dentro do dom\u00ednio de falha que ele observa. Aqui est\u00e1 o que testar antes de escolher uma ferramenta de monitoramento.<\/p>\n","protected":false},"author":39,"featured_media":34524,"comment_status":"closed","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[5170],"tags":[],"class_list":["post-34537","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-nao-categorizado"],"_links":{"self":[{"href":"https:\/\/www.dotcom-monitor.com\/blog\/pt-br\/wp-json\/wp\/v2\/posts\/34537","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/www.dotcom-monitor.com\/blog\/pt-br\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.dotcom-monitor.com\/blog\/pt-br\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.dotcom-monitor.com\/blog\/pt-br\/wp-json\/wp\/v2\/users\/39"}],"replies":[{"embeddable":true,"href":"https:\/\/www.dotcom-monitor.com\/blog\/pt-br\/wp-json\/wp\/v2\/comments?post=34537"}],"version-history":[{"count":0,"href":"https:\/\/www.dotcom-monitor.com\/blog\/pt-br\/wp-json\/wp\/v2\/posts\/34537\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/www.dotcom-monitor.com\/blog\/pt-br\/wp-json\/wp\/v2\/media\/34524"}],"wp:attachment":[{"href":"https:\/\/www.dotcom-monitor.com\/blog\/pt-br\/wp-json\/wp\/v2\/media?parent=34537"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.dotcom-monitor.com\/blog\/pt-br\/wp-json\/wp\/v2\/categories?post=34537"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.dotcom-monitor.com\/blog\/pt-br\/wp-json\/wp\/v2\/tags?post=34537"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}