如今企业面临的主要挑战是大规模管理 IT 基础设施,能够将资源匹配到应用需求,以及以简单、整体的方式管理各种不同类型的基础设施。应对这些挑战的直接解决方案是 Cisco Unified Computing System (UCS)。Cisco UCS 是融合的数据中心架构,集成计算、网络和存储资源以提高效率并实现集中管理。Cisco UCS 的目标是简化需要连接、配置、冷却和保护的设备数量,并为管理员提供通过单一界面管理一切的能力。
尽管 Cisco 服务器配备了高品质设备,但也无法保证绝无故障发生。硬件问题通常与磁盘驱动器、RAID 和电源有关。关键设备如处理器出现问题,可能导致服务器故障或运行缓慢,甚至产生数据丢失或损坏。IT 管理员应仔细监控服务器的物理健康状况。由于管理员无法每天检查每台服务器,他们需要一种解决方案,能够从单一地点监控所有 Cisco 环境,以预测问题、更快纠正问题或采取预防措施。
尽管 IT 管理员计划统一数据中心,统一计算系统中的服务器仍可能混杂。这种异构环境加大了硬件监控的复杂性,突显了混合监控工具监控多厂商硬件设备的必要性。
ManageEngine OpManager,凭借其 Cisco 网络监控 和 UCS 监控能力,帮助确保您的 Cisco UCS 环境及其关键组件始终运行正常,通过监控关键性能指标。OpManager 通过 Cisco UCS Manager API 收集 Cisco UCS 的实时数据,监控包括资源利用率、响应时间、CPU 负载、网络延迟和数据包丢失等关键性能指标。
OpManager 简明易懂的仪表盘详细展示 UCS 服务器硬件的健康和性能状态,并主动通知您关键服务器组件(如 UCS 机箱、刀片、CPU、电池、风扇速度、温度和电源)故障情况。
OpManager 的 Cisco UCS 监控器能让您:
使用 OpManager 基于阈值的监控,主动监控 Cisco UCS 服务器的健康和可用性。OpManager 帮助您跟踪关键性能指标,确保服务器及其硬件组件处于良好状态和正常运行。仪表盘视图将所有监控数据汇总为图形和表格,帮助您快速了解网络状况。支持 535 多家厂商,可扩展监控至任何本地或自定义应用程序。

OpManager 的 Cisco UCS 监控器仔细检查 Cisco 机箱内的服务器、内存模块和 Fabric 扩展器。OpManager 监控每个风扇和温度传感器,确保刀片服务器得到适当冷却。OpManager 还显示整体功耗,这在许多数据中心尤为重要,因为电源优化可能是关键问题。

Cisco 的机架式服务器种类繁多,配备多个处理器、内存模块和驱动单元。在可用设备中,处理器和内存模块被视为最关键的。如果处理器故障,会导致系统重启。您需要了解每个处理器是否正常运行;一旦处理器在重启时被禁用,必须收到通知。同样,监控内存模块也非常重要,因为主内存中单个错误可能引发严重的计算机崩溃,甚至导致数据损坏。
通过监控内存模块,您将获得准确的故障统计信息,在预测到故障时得到通知,并能采取预防措施。利用 OpManager 的 Cisco UCS 性能监控,全面跟踪与 内存、CPU, 和机架式主板相关的关键指标,确保性能最佳。

Cisco UCS Fabric Interconnect 用于将 Cisco UCS 服务器连接到网络。UCS Manager 也运行在 Fabric Interconnect 上。监控 Fabric Interconnect 可以提高网络可靠性,减少停机成本。OpManager 的 Cisco UCS 监控工具提供有关使用内存、功耗、输入电流和电压以及 Fabric 扩展器的详细信息。

UCS 还有风扇模块、以太网端口、I/O 模块、Fabric 扩展器和适配器单元等关键组件。这些组件也由 OpManager 的 Cisco UCS 监控器监控,以确保其健康且在最佳性能水平运行。

当检测到 Cisco UCS 环境中的故障时,会产生事件;多个相关事件将触发警报。OpManager 的 UCS 监控具备智能事件处理功能,关联原始网络事件,过滤无关事件,仅展示有意义的告警。OpManager 支持彩色编码告警,以用户友好的形式呈现。您还可以查看与告警关联的事件历史,并手动清除或删除告警。
OpManager 的告警机制 可通过短信和/或电子邮件通知您告警发生。OpManager 支持多种告警机制,可以在设备或服务宕机时发出警报。您可以为服务、应用程序或设备指定阈值规则,并在违反阈值规则时收到告警。通过指定触发告警前允许的违规次数,您可以为阈值配置增加更多智能。OpManager 还支持批量配置阈值。

除了对关键设备的高级监控外,OpManager 还提供报告,帮助 IT 管理员识别和预防常见问题。OpManager 提供简洁界面,内置 100 多个报告模板和超过 125 个现成报告。所有收集的 UCS 性能度量数据都存储在 OpManager 的数据库中,用于详细分析及生成月度和年度性能报告。
使用 OpManager 的 Cisco UCS 监控,您可以查看详细的性能报告,如:
OpManager 的 Cisco UCS 监控配备服务器 容量监控及其针对关键资源(如 CPU、内存和磁盘)利用率的预测报告。 您可以配置以确认资源利用率将在何时达到 80%、90% 和 100% 的分配容量。OpManager 通过分析历史增长模式和趋势,利用基于 AI 和 ML 的算法完成预测。这有助于提前规划容量,避免无序采购。
OpManager 的功能超越了 Cisco UCS 性能、可用性和健康的主动监控。凭借其高级功能,包括强大的 Cisco UCS 流量监控器,管理员可以深入了解网络动态、带宽使用情况和 Cisco UCS 环境内的通信模式。使用 OpManager 轻松监控机箱、机架、Fabric Interconnect 及其他 UCS 组件,并通过 OpManager 的 NFA 插件监控 Cisco UCS 流量。获取流量流向的详细分析和图表,避免停机,确保 Cisco UCS 环境内的最高生产效率。

感谢您的反馈!