Home » 解决方案 » 基础设施监控

监控每一层 您的应用程序所依赖的层面

服务器、网络设备、协议和内部系统——同时从公共互联网和您自己的网络内部进行监控。互联网基础设施按世界访问您的方式检查正常运行时间和协议。性能计数器从防火墙后收集SNMP和服务器指标。私有代理同时扩展到私有网络。一个平台,一个仪表板。
Dotcom-Monitor infrastructure monitoring dashboard showing protocol uptime, SNMP performance counters, Private Agents behind the firewall, and API/web-service checks across the full stack
10,000+

全球组织

99.99%

平台正常运行时间SLA

30+

全球监控地点

自1998年

网站监控领先者

Aflac logo — Dotcom-Monitor customer
Dell logo — Dotcom-Monitor customer
Comcast logo — Dotcom-Monitor customer
dish logo
citrix logo
xerox

什么是基础设施监控?

基础设施监控是对您的应用程序所依赖的服务器、网络设备、协议和内部系统的持续检查——确认它们在线、可达且性能在阈值范围内。Dotcom-Monitor同时从两个方向监控基础设施:互联网基础设施从外部检查可用性和协议,性能计数器从内部收集服务器和设备的深度指标(CPU、内存、磁盘、SNMP计数器)。私有代理将两者扩展到防火墙内部。

大多数监控工具只提供一个视角。外部检查器告诉您网站宕机但不知道原因。代理在主机上告诉您CPU使用率满载但不知道DNS解析刚刚开始对一半用户失败。真正的基础设施问题不尊重这种界限——证书过期,交换机丢包,磁盘满,邮件队列积压——破坏的层面往往不是您最先感受到问题的层面。

Dotcom-Monitor将这一差距整合到单一平台。互联网基础设施通过部署在六大洲主要互联网骨干网的监控代理运行协议和正常运行时间检查——这是外向内视角。性能计数器在您的网络内部安装一个轻量级收集器来拉取Windows性能计数器、Linux Collectd计数器和服务器及网络设备的SNMP数据——这是内向外视角。私有代理将所有检查类型带入私有网络,使内部应用、预发布和防火墙设备与公共设备采用相同方式监控。因为Web服务、Web应用程序和网页共享相同的仪表板,您可以追踪缓慢的结账过程,一直到正在交换的数据库服务器。

一个平台,覆盖每一层

全栈基础设施监控的构建模块

每个平台覆盖您基础设施的不同层面。将它们一起运行,单一仪表板即可显示可用性、协议健康状况、设备指标和用户体验 —— 并通过一个钻取路径,从红色警示块直达根本原因。

互联网基础设施 (ServerView)

来自全球代理的正常运行时间和协议检查 —— HTTP/HTTPS,DNS,SSL/TLS 证书,SMTP/POP3/IMAP 邮件,FTP,VoIP/SIP,TCP/UDP 端口,ICMP ping 和 traceroute。

性能计数器 (MetricsView)

由您网络内部代理收集的深度设备和操作系统指标 —— Windows 性能计数器,Linux Collectd,SNMP v1/v2/v3,及通过 REST 的自定义指标。

私有代理

针对没有公共 IP 的内部系统运行任何类型的检查。仅出站连接至云端 —— 无需入站防火墙规则,与公共监控拥有相同仪表板。

Web 服务 (WebView)

多步骤 API 和 Web 服务检查 —— REST,SOAP,GraphQL,WebSocket —— 涉及状态、延迟和负载的断言。监控内部健康端点和服务网格。

Web Applications (UserView)

脚本化的浏览器交易,涵盖全堆栈端到端操作,因此基础设施故障会表现为带有截图、视频和瀑布图的错误步骤。

Web Pages (BrowserView)

真实浏览器页面加载和核心网页核心指标检查,揭示后端、CDN 或第三方依赖项何时拖慢前端响应。

互联网基础设施(ServerView)· 外向内

来自公共互联网的协议和上线时间监控

互联网基础设施检查您的服务器、网络和服务,方式为外界实际访问的方式 — 通过分布于全球主要互联网骨干网的监控代理进行。多个代理的冗余检查验证每次故障后才通知您,以确保您获得真实警报,而非误报。

适用范围:网站与应用服务器 · DNS · 邮件 · VoIP · 网络设备 · 证书

Protocol and uptime monitoring showing DNS, SMTP, ICMP, SSL, and TCP port checks running from the public internet
SNMP and performance-counter monitoring reporting CPU, memory, and disk metrics from inside the network
性能计数器(MetricsView)· 内向外

来自您网络内部的 SNMP 与性能计数器监控

性能计数器覆盖外部检查无法看到的指标。在您的网络内部的单台机器上安装性能计数器代理,它从您的服务器和网络设备轮询性能数据 — 无需在每台机器上安装代理,因为一个收集器可以从任何有权限的远程节点收集数据。

适用范围:CPU · 内存 · 磁盘 · 交换机和路由器 · SNMP 设备 · 自定义遥测

私有代理 · 防火墙内

监控永远不会接触公共互联网的所有事物

内联网应用、暂存环境、内部 API 以及没有公共 IP 的设备仍然需要监控。在您可信网络内的 Windows 或 Linux 主机上部署私有代理——虚拟机、跳板机或专用设备——它会打开一个到 Dotcom-Monitor 的单向出站 HTTPS 会话。无需入站防火墙规则。无需打孔。

适用范围:内部应用 · 暂存环境 · 仅 VPN 系统 · 防火墙设备 · 预生产环境

Private Agents deployed behind the firewall monitoring internal servers and applications that never touch the public internet
API and web-service infrastructure monitoring validating the plumbing between microservices and third-party integrations
Web 服务(WebView)· 服务层

监控服务之间管道的 API 和 Web 服务检查

基础设施不仅仅是硬件——它是将其连接在一起的内部 API 和服务。Web 服务针对 REST、SOAP、GraphQL 和 WebSocket 端点运行多步骤检查,断言状态码、响应时间和有效负载内容,以便您在服务降级之前就知道。

适用范围:健康端点 · 内部 API · 微服务 · 消息队列 · 服务网格

体验层

用用户感知的方式发现基础设施故障

Web 应用和网页位于堆栈顶部并进行端到端测试。当基础设施下层出现故障时,会以步骤失败或页面缓慢的形式表现出来——并附带证据证明故障发生的位置。

Web 应用(用户视图)—— 跨全栈的脚本事务

使用 EveryStep 录制器记录真实用户路径——登录、搜索、加入购物车、结账——并从真实浏览器按计划运行。后端超时、证书过期或依赖失败会在确切步骤停止脚本,您会获得故障时刻的截图、会话视频、控制台日志和瀑布图。

网页(BrowserView)— 真实浏览器页面加载与核心网页指标

测量最大内容绘制时间、交互时间和实际桌面及移动浏览器的加载瀑布图。元素级定时显示,是缓慢的后端响应、过载的服务器还是第三方依赖拖慢页面,而非前端代码。

全球与私有覆盖

从用户所在的所有地方及您的内部网络监控

互联网基础设施检测由跨越六大洲的三级数据中心代理运行,因此您能在收到支持工单前捕获地区DNS失败或ISP路由变更。性能计数器和私有代理运行于您的网络内部,因此防火墙服务器和SNMP设备也得到同等严格监控。两者均汇入同一仪表板、同一报警引擎及一套SLA报告。

6

监控代理所在大洲数

60s

频率可达1分钟一次

v1/v2/v3

支持的SNMP版本

1998

自1998年监控基础设施

Infrastructure monitoring alert routing panel showing incident escalation across on-call, Slack, PagerDuty, and email
工作原理

四步实现零到全栈覆盖

1

添加目标

将互联网基础设施指向公共URL、主机和协议。将相关检测分组到设备,以保持报告和警报整洁。

2

部署您需要的代理

安装性能计数器代理以收集SNMP和性能计数器,安装私有代理以访问防火墙后面的任何内容。

3

设置基线和阈值

建立基线性能,定义每个指标的可接受阈值,并选择最短一分钟的检查频率。

4

路由警报和报告

将已验证的警报发送给正确的团队,通过冗余检查抑制误报,并导出SLA和趋势报告。

功能

什么使其适用于真实的值班轮换

全球监控网络

分布于六大洲的三级检查点。从特定区域运行检查,以隔离地理路由、CDN和ISP级别的问题,而不是猜测故障是您这边的还是网络的。

统一仪表板

互联网基础设施协议检查、性能计数器设备指标、Web服务API和前端检查汇聚于一视图。可在几秒钟内从整体健康状态图块深入到单个失败检查。

基线、阈值和趋势

性能计数器为每个计数器建立基线性能,在报告中捕获趋势,当值偏离您可接受范围时,针对变量或数据点触发警报。

已验证的警报,减少误报

多个代理的冗余检查在您收到通知前确认故障。可路由至PagerDuty、Slack、Teams、电子邮件、短信、语音、SNMP陷阱或Webhook — 附带快照和路由跟踪。

PagerDuty
Slack
SNMP 陷阱
短信
Webhook

安全设计

私有代理仅进行出站连接,因此没有任何内部内容暴露给互联网。监控防火墙和仅限 VPN 的系统,无需打开任何入站端口。

报告与 SLA 跟踪

实时仪表盘、定期 PDF/CSV 导出,以及针对正常运行时间、响应时间和错误率的 SLA 报告,以满足您的阈值要求 — 并提供 MSP 和代理商的品牌白标选项。

现实世界中的应用

运行时间不可妥协的基础设施监控

团队如何结合互联网基础设施、性能计数器和私有代理来保持关键基础设施的健康。

数据中心与托管

性能计数器跟踪机架中服务器和网络设备的 CPU、内存、磁盘及 SNMP 计数器;互联网基础设施确保上层服务保持可达。基线能在故障节点影响租户之前发现其异常。

企业 IT 与内部应用

私有代理监控防火墙后的内联网门户、SSO 和预发布环境,同时互联网基础设施监控 DNS、证书和邮件。公共与私有共用一个仪表盘。

客户: 戴尔、思杰、施乐。

电信与 VoIP

SIP 呼叫发起检查确保语音服务实际连接,ping 和 traceroute 映射网络路径,性能计数器从运营商级交换机和路由器拉取 SNMP 指标。

客户: 康卡斯特、Dish。

金融服务与保险

邮件服务器全周期检查、证书到期警报及满足合规审计的 SLA 报告。冗余验证防止误报进入受监管的值班轮班。

客户: Aflac。

零售与电子商务

端口和数据库连接性检查,通过Web服务的API健康,以及Web应用程序结账脚本 —— 因此基础设施故障会在影响转化报告之前很久就表现为步骤故障。

混合云与多云

因为监控是内外兼顾,运行时环境无关紧要。裸机、虚拟机、Kubernetes 或无服务器——外部检查公共端点,内部检查主机,方式都一样。

对比分析

Dotcom-Monitor 与传统基础设施监控

大多数基础设施工具优先使用代理,且按主机计价,覆盖全部设备代价快速上升。Dotcom-Monitor 结合无代理的外部检测和轻量级内部采集器——按监视器计价,不按设备。

能力
Dotcom-Monitor
Datadog
SolarWinds
PRTG
Site24x7
来自全球代理的外向协议与正常运行时间检查
是
附加组件
附加组件
有限
是
SNMP v1/v2/v3 和性能计数器采集
是
是
是
是
是
一个代理采集多个远程节点的数据
是
每主机
部分
是
部分
私有代理在防火墙后运行完整检查集
是
部分
部分
是
是
完整周期邮件(SMTP → IMAP/POP3)检查
是
否
部分
部分
部分
VoIP/SIP呼叫放置监控
是
否
部分
部分
否
同一平台中的前端(Web应用程序/网页)
是
是
部分
否
是
按每个监视器统一定价 — 无主机或摄取费用
是
每主机
按节点计费
基于传感器
基于计划
白标 / MSP 转售商报告
是
否
部分
部分
是
自1990年代以来专注的监控供应商
1998
2010
1999
2003
2006

“附加/部分/有限” = 带有限制提供,作为独立模块,或在更高级别。竞争对手的功能和定价模型经常变化,数据于2026年7月汇编;请向各供应商核实最新详情。

为接收通知的人而设计

各角色实际如何使用基础设施监控

捕捉悄无声息破坏应用的协议和路径

使用互联网基础设施监控 DNS、SSL/TLS 证书、SMTP/POP3/IMAP、FTP、VoIP/SIP 以及 TCP/UDP 端口。从多个区域运行 ping 和 traceroute 以发现 ISP 路由变化和丢包,并通过性能计数器和 SNMP 轮询交换机和路由器。

在用户察觉之前了解服务器问题

通过性能计数器收集 Windows 性能计数器和 Linux Collectd 指标,在 CPU、内存和磁盘上设置基线和阈值,一旦节点偏离即可收到警报——一个采集器覆盖多台机器。

从症状追踪事件源头

在同一仪表盘中关联失败的 Web 应用步骤或缓慢的 Web 服务 API 与底层主机指标。基于合成检查来控制部署,并用 SLA 报告而非电子表格追踪错误预算。

监控内部系统而不暴露它们

私有代理仅出站连接,因此防火墙和仅 VPN 可访问的系统无需开放入站端口即可监控。证书过期和 DNSBL 检查弥补常见安全漏洞;SLA 报告满足审计需求。

集成

适配您团队已经运行的堆栈

告警、仪表盘和数据流入团队已使用的工具中。

事件响应与值班

将不同设备路由至不同升级链路,在维护窗口期间抑制告警,并通过团队依赖的每个频道发送通知。

PagerDuty
Slack
邮件 / 短信 / 语音
Microsoft Teams
Opsgenie
SNMP 陷阱

工单,开发工具及 CI/CD

自动将验证失败转为工单,并从您的管道直接触发部署后基础设施检查。

JIRA
ServiceNow
GitHub
GitLab
Jenkins

自定义 API 和 Webhooks

Dotcom-Monitor REST API 配置监控器、获取历史数据并管理配置 — Performance Counters 通过 REST 接受您自有传感器上报的自定义指标。

REST API
Webhooks
自定义指标
常见问题

常见问题解答

如果您的问题未在此列出,联系我们 — 有真实工程师为您解答。

基础设施监控是对您的应用所依赖的服务器、网络设备、协议和内部系统的持续检查,确保其运行、可达且性能满足阈值。Dotcom-Monitor 从两个方向同时覆盖:Internet Infrastructure 从网络外部检查可用性和协议,而 Performance Counters 从内部采集操作系统和设备深层指标(CPU、内存、磁盘、SNMP 计数器)。

Internet Infrastructure 是自外向内的监控:全球监控代理检查正常运行时间、响应时间和协议——HTTP、DNS、SMTP/POP3/IMAP、FTP、SIP/VoIP、TCP/UDP 端口、ICMP ping 和 traceroute——模拟外部世界访问您的基础设施的方式。Performance Counters 是自内向外的监控:本地安装的代理采集 Windows 性能计数器、Linux Collectd 计数器和 SNMP v1/v2/v3 设备数据,并将其汇总到同一仪表盘中以进行基线设定、阈值和告警。大多数团队两者兼用。

您需在网络内部的某台机器上安装 Performance Counters 代理。它轮询 Windows 性能计数器、Linux Collectd 计数器和支持 SNMP 的设备——v1/v2 使用社区字符串和 OID,v3 使用用户名和带加密的密码。一个代理可以收集它有权限访问的远程节点(这些节点需管理员或“性能监控用户”权限),因此不必在每台机器上部署代理。Dotcom-Monitor 按计划轮询代理并汇总数据用于基线、阈值告警和趋势报告。

可以。在您网络内的 Windows 或 Linux 主机上部署 Private Agent。该代理仅建立出站连接至 Dotcom-Monitor,无需设置入站防火墙规则,并执行完整任务集:HTTP/HTTPS、REST、SOAP、GraphQL、WebSocket、网页、Web 应用、Internet Infrastructure 及 Performance Counters 检查内部系统。结果与您的公开监控器显示在同一仪表盘中。

Internet Infrastructure 检查网页和应用服务器(HTTP/HTTPS,包括 500 等错误响应)、邮件服务器(SMTP、POP3、IMAP,包括完整的发送和接收周期)、DNS 服务器、FTP 服务器、VoIP/SIP 系统、流媒体服务器、TCP 和 UDP 端口,以及通过 ICMP ping 和 traceroute 进行的原始 IP 级连接。它还检查 SSL/TLS 证书的有效性和 DNS 黑名单(DNSBL)状态。

通过在故障产生的层级捕捉到故障。性能计数器中性能下降的磁盘或上升的 CPU 计数器可在应用变慢前警告您;Internet Infrastructure 的协议检查失败可定位是 DNS、SSL、端口,还是应用层出错;告警中的 traceroute 显示数据包在哪段路径丢失。这些分层的证据意味着减少猜测哪个组件失败的时间,从而加快修复速度。

不需要。Internet Infrastructure 的检查完全由 Dotcom-Monitor 外部代理执行,您这边无需安装任何东西。性能计数器只需网络段内一台机器安装代理——它会从其他有权限的节点收集数据。一个私有代理同样覆盖多个内部目标。您仅需在需要访问内部网络的地方安装代理,而非每台机器。

通过邮件、短信、电话、SNMP Trap、PagerDuty、Slack、Microsoft Teams、Opsgenie 和 webhook 发送警报。条件可设置为在冗余代理均确认失败时触发,从而避免误报,警报中可附带网站截图和 traceroute 用于诊断。报告包括基线、趋势报告、阈值报告和 SLA 报告,还支持为 MSP 提供白标选项。

提供 30 天免费试用,包含所有平台的完整功能访问,包括私有代理和性能计数器。开始使用不需信用卡。

价格基于监控器数量、检查频率和平台组合计算——非按主机或座位收费,也不收取数据摄入量费用。请参阅价格页面了解当前方案,或联系销售获取定制报价。

监控您应用所依赖的每一层

几分钟内设置首个检查,按需添加性能计数器和私有代理。无需信用卡,无需销售电话即可开始。