OpManager 受到 5000+ 企业的信赖

圣戈班
NASA
Time Warner Cable
巴黎欧莱雅
Siemens
DHL

OpManager 支持的关键服务器监控功能

OpManager 具备基于代理和无代理的机制来监控服务器设备。扫描并发现设备后,OpManager 会根据厂商、类型和功能等多种因素识别并分类服务器。您可以 监控服务器正常运行时间、进程、服务以及关键指标,如正常运行时间、CPU、内存、进程、服务和磁盘空间。让我们逐一了解这些功能。

通过服务器可用性监控确保 24/7 正常运行

通过定期的正常运行时间检查确保服务器的高可用性。 OpManager 使用 ICMP、SNMP 和 TCP 检查设备的可用性,并为每个设备维护可用性时间线。您可以自定义正常运行时间检查的监控间隔,并设置不可用报警。此外,您还可以跟踪响应时间和丢包率,以确保质量和可用性。

OpManager 中的可用性统计和内存利用率
OpManager 中的性能监控

通过跟踪关键绩效指标了解服务器性能

使用专用的厂商特定性能监控器跟踪服务器性能,监控 CPU、内存、流量、CPU 温度和磁盘空间等指标。OpManager 允许您为监控指标设置三级报警阈值,并基于性能数据生成上下文丰富的警报和图表。

轻松管理关键服务和进程

获取 进程 和服务中断的即时警报。 您可以使用 OpManager 获取服务器中所有活动的进程和服务,并为它们设置定期监控检查。当任何进程或服务停止运行时,您将收到指定中断、进程或服务及设备的警报。您还可以配置 OpManager 远程终止并重启服务或进程。

OpManager 中服务和进程的响应时间及关键绩效指标(KPI)监控
OpManager 中的服务器机架视图和数据中心可视化

可视化服务器阵列和数据中心

关注服务器机架以增强监控能力。 您可以使用 OpManager 的机架构建器映射服务器机架,绘制数据中心楼层、虚拟主机和虚拟机、二层拓扑等。您还可以利用仪表板和图表快速分析服务器性能。仪表板和图表通过颜色编码和时间戳标记服务器信息,帮助您快速获得可执行的洞察。

利用自动化事件响应解决服务器问题

通过 OpManager 的自动化工作流防止长时间停机和故障。 您可以创建顺序的、基于结果的工作流操作。OpManager 提供超过 70 种操作,支持无代码拖放式工作流构建器。您只需根据前一个操作的结果安排每个操作,即可创建直观的修复工作流。针对服务器,您可以使用工作流执行重启服务、启动虚拟机、运行脚本等操作。

OpManager 中的自动化工作流响应
OpManager 中的事件日志监控

通过监控日志持续关注服务器

监控服务器日志,如 Windows 事件日志和 syslog,随时了解服务器状态。您可以为特定的 Windows 事件日志设置警报,并创建规则以提醒符合条件的 syslog。您还可以使用预配置规则监控 Exchange、IIS、MS SQL 和 ISA 服务器的应用日志。

OpManager 的服务器监控有何独特之处?

 

ML 驱动的服务器管理

OpManager 配备强大的 ML 引擎,使用先进算法预测被监控系统的性能。通过自适应阈值,您可以使用 OpManager 计算、设置和调整所有监控指标的报警阈值。这提升了异常检测能力,消除了报警泛滥和误报。

 

多厂商监控支持

使用 OpManager,您可以轻松从统一控制台监控和管理多厂商环境,包括物理和虚拟服务器。无缝管理来自 Dell、HP、IBM、Huawei、Oracle 和 Lenovo 等领先厂商的物理服务器,以及 VMware、Hyper-V、Nutanix、Xen 和 Proxmox 等平台的虚拟服务器。

 

一体化服务器监控(MSSQL、Exchange、DC、IPMI)

无论您的服务器用于数据库操作、应用托管、邮件还是域管理,OpManager 都能监控。您可以监控域控制器,使用 IPMI 管理服务器硬件,跟踪 MS SQL 事务,监控 Exchange 服务器,并使用专用指标监控不同服务器。

关键服务器性能指标有哪些?

  • CPU 或内存
    利用率:
    Percentage of CPU or RAM in use. You can set alarm thresholds for higher values to prevent bottlenecks, poor performance, or resource scarcity.
  • 活跃
    事务数:
    Number of ongoing server operations. Helps identify load, potential deadlocks, or slow processes impacting performance.
  • 网络
    带宽使用率:
    Amount of data transferred over the network. High usage indicates heavy traffic, saturation, or data transfer operations.
  • 数据
    文件大小:
    Cumulative size of application/database data files. You can track growth to perform capacity planning.
  • 数据包
    丢失率:
    Percentage of data packets failing to reach destination. High rates indicate network issues.
  • 活跃数据库
    连接数:
    Number of open database connections. High counts indicate application demand, connection pooling issues, or resource limits.
  • 接口
    错误率:
    Percentage of errors on network interfaces. High rates suggest physical network problems, impacting server connectivity.
  • 每秒登录次数
    Rate of server authentications. Spikes can indicate high demand or potential security threats.
  • IO读取
    和写入速率:
    Speed of disk read/write operations. High rates suggest disk-bound applications or I/O bottlenecks.
  • 每秒事务数
    Number of completed server operations per second. Indicates server throughput and overall performance capacity.
  • 总计
    活跃锁数:
    Number of held locks on server resources. High counts indicate contention, poor concurrency, or potential deadlocks.
  • 日志文件
    使用百分比:
    Disk space consumed by log files. You can set up monitors to ensure log rotation, archiving, and to prevent disk space exhaustion.
  • 平均
    磁盘延迟:
    Average time for disk I/O operations. High latency indicates slow disk performance, impacting application responsiveness.
  • 平均
    锁等待时间:
    Average time processes wait for locks. High wait times indicate resource contention, leading to performance degradation.
  • 设备
    分区详情:
    Information about server disk partitions. Helps with capacity planning, identifying imbalances, and space management.
  • 每秒死锁数
    Frequency of deadlocks. High rates severely impact application performance and require immediate resolution.
  • 数据库
    数据空间:
    Total disk space consumed by the database. Monitor growth to perform capacity planning and efficient database management.
  • 实例
    数量:
    Number of running application/service instances. Helps ensure scalability, resource allocation, and service availability.
  • 缓存
    命中率:
    Percentage of requests served from cache. High ratio indicates efficient caching, faster responses, and reduced load.
  • 线程
    数量:
    Total number of active threads/processes. High counts can indicate resource contention, inefficient code, or memory exhaustion.

OpManager中服务器监控的工作原理

支持的Windows服务器版本 支持的Linux服务器版本 服务器监控协议
Windows NT、2000 Red hat enterprise SNMP v1和v2c
Windows 2003 SUSE SNMP v3
Windows 2008、2008 R2 Ubuntu CLI
Windows 2012、2012 R2 Fedora WMI
Windows 2016 Debian PrismAPI
Windows 2019 CentOS APIs

服务器监控常见问题解答

OpManager中服务器监控的需求是什么?

 

OpManager对服务器监控没有任何特定要求。服务器包含在OpManager的常规基于设备的许可中。您可以监控许可中每台服务器的无限指标,包括:正常运行时间、性能、硬件和连接的接口。

为了发现、识别、分类和监控服务器,OpManager使用类似于c的技术

您必须为相应的服务器提供凭据,以便 OpManager 访问并收集服务器数据。或者,您可以安装一个轻量级监控代理。

服务器监控推荐的监控间隔是多少?

 

如何在 OpManager 中为服务器性能指标设置告警?

 

ML 驱动的自适应阈值如何准确计算所有指标的阈值?

 

除了正常运行时间和性能,OpManager 还能监控服务器的哪些内容?

 

服务器机架视图和数据中心楼层视图有什么帮助?

 

OpManager 适合家庭服务器还是数据中心服务器模型?

 

为什么 OpManager 被认为是服务器监控的首选?

 

通过统一控制台实现全面服务器监控

受到全球客户的喜爱

 

“易于实施,卓越支持,低成本工具 - IT服务行业团队负责人”

评审者角色:基础设施与运营

公司规模:5亿至10亿美元

自2011年以来我们一直使用OpManager,整体体验非常出色。该工具在为我们的组织及所支持的客户提供价值方面发挥了关键作用。支持服务优秀,员工全权负责解决问题。创新从未停止,新版本中体现得淋漓尽致。

“OpManager领先竞争对手10步,距离无可匹敌仅一步之遥 - 政府组织网络服务经理”

评审者角色:基础设施与运营

公司规模:5,000至50,000名员工

我与ManageEngine有长期合作关系。OpManager总缺少一两个功能,若有这些功能将成为市场上真正最好的工具,但总体而言,它是市场上最全面且易用的产品。

“易于实施,功能丰富的目录,支持方面还有提升空间 - IT服务行业NOC经理”

评审者角色:项目与组合管理

公司规模:5亿至10亿美元

供应商在实施和POC阶段提供了试用许可证,支持力度大。功能请求和反馈通常能迅速得到响应。实施阶段供应商支持充足,部署后支持也非常充分,但供应商仍有改进空间。

“出色的监控工具 - 金融行业CIO”

评审者角色:CIO

公司规模:10亿至30亿美元

ManageEngine提供了一套工具,提升了我们内部应用的可用性。从监控、管理到告警,我们能够实现数据中心的峰值性能。

“简单实施,易于使用,非常直观。- IT服务行业首席工程师”

评审者角色:企业架构与技术创新

公司规模:2.5亿至5亿美元

 

ManageEngine的支持对我们所有的查询都响应迅速。

Capterra
Getapp
Software Advice
G2
Altaleb Alshenqiti

“OpManager帮助我监控数据中心及设备的各个方面,如服务器、交换机和路由器。它快速、直观且集中管理,使用OpManager无需成为专家。”

Altaleb Alshenqiti

NGHA

Donald Stewart

“Crest Industries的IT经理Donald Stewart对ManageEngine OpManager的端到端网络监控软件非常满意。它易于使用,提供路由器的故障和性能管理。”

Donald Stewart

IT 经理,Crest Industries

John Rosser

“Yale Chase 的 MIS 经理 John Rosser 讲述了 ManageEngine OpManager 的主动性以及他的组织如何从中受益。”

John Rosser

MIS 经理