网络性能监控(NPM)是指持续测量、分析和管理计算机网络性能的过程。通过监控流量、延迟、丢包、带宽利用率和正常运行时间等关键指标,确保网络高效、安全且停机时间最小。
- 目标:确保网络性能最佳,主动识别和解决问题,最大限度减少停机时间。
- 关键指标:延迟、可用性、丢包率、吞吐量、抖动和错误率。
网络性能监控(NPM)有多种类型,取决于所观察的网络具体方面:
- 实时监控:提供网络健康和性能的实时数据,用于快速诊断和即时故障排除。
- 端到端监控:跟踪两个设备之间整个路径的网络性能,提供多跳延迟、抖动和丢包率的洞察。
- 基础设施监控:专注于监控构成网络骨干的物理设备,如路由器、交换机、防火墙和服务器。
- 应用性能监控 (APM):监控依赖网络的应用性能,帮助识别影响应用性能的网络相关问题。
- 带宽监控:测量网络中传输的数据量,提供带宽利用率和瓶颈的洞察。
- 流量分析:专注于分析网络中的数据流,识别趋势、拥塞和异常。
网络性能监控系统通过持续收集网络各点的数据来分析其性能。它们通常的工作方式如下:
- 数据收集:OpManager 使用 SNMP(简单网络管理协议)、NetFlow、sFlow 和 WMI 等协议从网络设备收集实时数据。
- 性能指标:这些工具测量关键性能指标(KPI),如带宽使用率、丢包率、延迟、错误率和吞吐量。
- 阈值和警报:用户可以为关键指标设置阈值。当这些阈值被突破(例如高延迟或带宽拥塞)时,系统会发送自动警报。
- 可视化:NPM 系统以图表、图形和仪表盘的形式展示网络性能数据,使网络管理员能够快速识别问题。
- 故障排除和报告:OpManager 支持深入诊断和历史报告,帮助排查持续性问题或优化网络设计。