安排演示

Amazon Redshift 监控

在影响您的业务之前消除 Redshift 运行缓慢问题

Amazon Redshift 中的查询缓慢、超时和宕机可能导致分析和运营停滞。当性能下降时,每个团队——财务、运营、分析和客户服务——都会感受到影响。成本上升,报告延迟,决策者受损。

ManageEngine Applications Manager 的 Amazon Redshift 监控帮助您领先应对性能和成本挑战。实时获得 Redshift 集群的可见性,及早发现问题,优化性能,确保您的分析顺畅运行。

获取 Redshift 健康和性能的可视化

Applications Manager 的 Amazon Redshift 监控收集了按资源利用率、网络吞吐量、存储健康和查询性能分类的多种指标。这些指标对于跟踪 Redshift 集群以及领导节点和计算节点的健康和性能至关重要。

关注资源利用率

监控资源利用率可防止资源争用,提高并行性能,并确保所有节点的工作负载平衡。

CPU 利用率

高 CPU 使用率通常表示低效查询或资源密集型工作负载导致瓶颈。通过测量集群中所有节点(领导和计算)的总 CPU 使用率,快速识别瓶颈。

磁盘利用率

监控磁盘空间使用百分比,提供存储不足预警。通过在性能受影响之前触发清理、清扫或调整大小操作,防止磁盘饱和。

数据库连接数

监测活动数据库连接数,确保集群在容量范围内运行,避免资源争用。

读/写吞吐量

跟踪数据吞吐量,以衡量存储 I/O 效率并检测工作负载不平衡或磁盘争用。

网络吞吐量(入站/出站)

监控集群节点与客户端之间传输的数据量,检测可能影响查询性能或数据摄取速度的网络瓶颈。

监控查询健康状况和数据库工作负载

跟踪多个关键领域的综合指标,包括查询性能、资源利用率、工作负载管理和存储健康。快速定位查询变慢,消除低效扫描,即使在高峰负载期间也能保持可预测的响应时间。

  • 监控查询持续时间(长、中、短)以识别影响用户体验的缓慢或低效查询。
  • 跟踪每秒执行的查询数(查询吞吐量),包括长查询、中查询和短查询,帮助您衡量工作负载强度并调整并发以实现最佳性能。
  • 详尽了解查询生命周期阶段,了解解析和优化 SQL 语句所花费的时间(查询规划时间)、在 WLM 队列中等待的时间(查询等待时间)、提交时间(查询提交时间)等。
  • 跟踪 QueryExecutingRead、QueryExecutingUnload、QueryExecutingInsert、QueryExecutingDelete、QueryExecutingUpdate、QueryExecutingCtas、QueryExecutingCopy 等各阶段所用时间。
  • 监控并发扩展指标,包括 ConcurrencyScalingClusters 和 ConcurrencyScalingSeconds,跟踪额外集群自动启动的频率及持续时间,用于处理查询工作负载高峰。这些指标帮助评估对并发扩展的依赖以维持峰值时的性能,优化集群规模,通过最小化不必要的扩展管理成本,并识别提升查询效率和工作负载分布的机会。

确保集群操作和网络性能的可靠性

实时查看连接健康、网络吞吐量和集群可用性。监控维护模式状态(集群状态)有助于确保操作或部署不会负面影响系统可用性或查询执行,因为集群维护或重启后,查询可能会短暂变慢。

利用节点级洞察优化集群效率

监控关键节点级指标,如读写吞吐量、入站和出站网络吞吐量及节点磁盘活动。这些洞察帮助您识别节点特定的瓶颈,检测工作负载分布不均,并确保每个计算节点高效运行。通过了解节点级性能,您可以主动解决吞吐量问题,平衡工作负载,保持所有节点的集群性能一致。

Applications Manager 还提供以下 Amazon 服务的监控支持:

几分钟内开始使用 Amazon Redshift 监控!

迈出优化 Amazon Redshift 集群性能和可用性的第一步。 下载 30 天免费试用版 Applications Manager 并亲自探索 Amazon Redshift 监控功能!

受到全球客户喜爱

“卓越工具,具备广泛的监控能力”

它允许我们跟踪关键指标,如响应时间、资源利用率、错误率和事务性能。实时监控警报及时通知我们任何问题或异常,使我们能够立即采取行动。

评审者角色:研发

carlos-rivero
“我喜欢 Applications Manager,因为它帮助我们检测服务器和 SQL 数据库中存在的问题。”
Carlos Rivero

技术支持经理,Lexmark

全球数千家领先企业信赖