本章节主要介绍在云环境概览页面中,针对云环境整体监控信息的概括说明,帮助用户迅速盘点云环境内各类监控对象资源数量、异常状态、告警信息等关键信息。其中,在云平台的顶部导航栏中,依次选择[产品与服务]-[可观测性]-[全局视图],然后在左导航栏中,选择[云环境概览],即可访问“云环境概览”页面。
云环境概览页面每5分钟会自动进行一次监控数据更新,如果您需要查看实时数据,可以点击页面右上角的刷新按钮查看各项监控数据信息。
云环境
云环境 是对整个环境的概况展示。展示云环境的总数,在线和离线状态的数目,以及各个云环境的名称、IP、状态、告警数量、描述的具体数据。
云环境监控对象
云主机 展示项中您可以清晰查看云主机数量,分状态统计所有云环境的云主机;Pod数量,分状态统计所有云环境的Pod;节点数量,分状态统计所有云环境的节点;对接存储数量,分 MetaStor容量型、MetaStor性能型、其他 三类统计所有云环境对接的存储集群。
云环境状态
云环境状态展示不同云环境下的各类监控对象的实时告警和资源使用情况。
实时告警
实时告警展示所选云环境的实时告警,包括告警名称、详情、级别、状态、分类/组件、开始时间、更新时间7类列项信息。
资源使用情况
资源使用情况展示所选云环境的云主机、Pod、节点三类资源对象的各类监控指标的使用量、使用率、时延情况,并以TopN视图形式表现。
云主机资源使用情况
云主机资源使用情况包括云主机负载TopN、云主机CPU争用TopN、云主机CPU使用量TopN、云主机CPU使用率TopN、云主机内存使用量TopN、云主机内存使用率TopN、云主机磁盘读延迟TopN、云主机磁盘写延迟TopN、云主机磁盘空间使用量TopN、云主机磁盘空间使用率TopN。
Pod资源使用情况
Pod资源使用情况包括Pod重启次数(最近一小时)、Pod CPU使用量TopN、Pod内存使用量TopN、Pod持久卷读延迟TopN、Pod持久卷写延迟TopN、Pod持久卷空间使用量TopN、Pod持久卷空间使用率TopN。
节点资源使用情况
节点资源使用情况包括节点负载TopN、节点CPU使用量TopN、节点CPU使用率TopN、节点内存使用量TopN、节点内存使用率TopN、节点根目录使用量TopN、节点根目录使用率TopN、节点磁盘读延迟TopN、节点磁盘写延迟TopN。
![]()
云主机部分图表是在详细监控模式的虚机情况下才有的数据(包括:云主机负载TopN,云主机 CPU 争用TopN,云主机磁盘空间使用量TopN,云主机磁盘空间使用率TopN),标准监控模式下图标暂无数据。
![]()
可观测服务将监控所有在线节点的运行情况,当节点处于离线状态时(节点控制网络与集群无法联通),可观测服务将不再监控该节点的运行状态。集群中节点被删除时,可观测服务仍会保留节点删除前的监控信息。该部分信息不会随着节点删除而被删除,而是随着监控数据过期后被自动清理。平台默认保存最近30天的监控数据。