检测到您已登录华为云国际站账号,为了您更好的体验,建议您访问国际站服务网站 https://www.huaweicloud.com/intl/zh-cn
不再显示此消息
Administrator权限,若无Security Administrator权限会出现权限异常提示,请联系账号管理员修改权限。 云监控服务提供系统策略及操作与策略权限一览表,请参见:云监控服务系统策略。 图1 查看权限 父主题: 权限管理
理Agent。 云监控服务仅支持通过管理员账号权限(Linux操作系统使用root用户,Windows操作系统使用Administrator用户)操作云监控插件。使用管理员账号具有一定风险,如果操作不当可能导致系统稳定性问题或数据安全问题,请谨慎操作。 前提条件 已成功安装Agent插件。
情况不同的监控需求。 操作步骤 登录云监控服务管理控制台。 选择“监控看板 > Dashboards”,单击“创建Dashboard”。 系统弹出“创建Dashboard”窗口。 配置参数。 名称:表示监控看板名称,该参数只能由中文、英文字母、数字、下划线、中划线组成,且长度不超过128。
以及中划线。 环境准备 以Ubuntu 18.04系统和Prometheus 2.14.0版本为例。 表2 环境准备 环境条件 描述 Prometheus prometheus-2.14.0.linux-amd64 ECS操作系统 Ubuntu 18.04 ECS私网IP 192
我的配额”。 系统进入“服务配额”页面。 图1 我的配额 您可以在“服务配额”页面,查看各项资源的总配额及使用情况。 如果当前配额不能满足业务要求,请参考后续操作,申请扩大配额。 如何申请扩大配额? 登录管理控制台。 在页面右上角,选择“资源 > 我的配额”。 系统进入“服务配额”页面。
支持GPU监控的环境约束 仅支持Linux操作系统,且仅部分Linux公共镜像版本支持GPU监控,详情见:Agent支持的系统有哪些? 支持的规格:G6v、G6、P2s、P2v、P2vs、G5、Pi2、Pi1、P1系列的ECS,P、Pi、G、KP系列的BMS。 已安装lspci工
满足您对云服务运行情况不同的监控需求。 操作步骤 登录云监控服务管理控制台。 选择“我的看板 > 自定义监控看板”,单击“创建看板”。 系统弹出“创建看板”窗口。 配置参数。 名称:表示监控看板名称,该参数只能由中文、英文字母、数字、下划线、中划线组成,且长度不超过128。 归
ECS SYS.ECS 因系统故障触发重部署 startAutoRecovery 重要 弹性云服务器所在的主机出现故障时,系统会自动将弹性云服务器迁移至正常的物理机,迁移过程中系统会自动重启云服务器。 等待虚拟机迁移成功,状态恢复正常。 实例重部署开始。 因系统故障重部署已完成 endAutoRecovery
使用hinicadm mode -i <dev_id>命令采集。 HiNIC网卡核温 HiNIC网卡核温。 使用hinicadm temperature -i <dev_id>命令采集。 HiNIC网卡事件记录 HiNIC网卡心跳丢失计数、PCIE异常计数、芯片错误计数、芯片健康状态等。
Agent版本特性 本章节为您介绍云监控插件的版本发布信息。 CES Agent支持的镜像列表,参见 Agent支持的系统有哪些? CES Agent迭代版本已知版本特性如下: 2.7.6.1版本 分类 说明 发布时间 2025-04-15 新特性 基于2.7.6版本: NPU指标采集加固。
CES安全配置建议 本文提供了CES使用过程中的安全最佳实践,旨在为提高整体安全能力提供可操作的规范性指导。根据该指导文档您可以持续评估CES资源的安全状态,更好的组合使用CES提供的多种安全能力,提高对运维数据的整体安全防御能力,保护存储在平台内的运维数据不泄露、不被篡改,以及数据传输过程中不泄露、不被篡改。
配置指标告警 监控最核心的职责是帮助用户发现问题,而问题的发现是依赖监控系统中对告警规则的配置,告警规则配置的覆盖率、准确率将直接影响监控系统的故障发现率。您可以对主机监控、云服务监控中的指标项设置告警规则,也可以在不同的监控对象层级(全部资源、资源分组、指定实例维度)设置告警规则。
云监控集中管理各云产品的系统事件和自定义事件。便于在业务故障时,快速分析并定位问题。本章节介绍如何查看事件监控的监控数据。 查看事件监控 登录云监控服务管理控制台。 单击业务左侧导航栏的“事件监控”,进入“事件监控”页面。 在“事件监控”页面,默认展示近24小时的所有系统事件和自定义事件。
可用探测点等趋势来展示当前站点的访问情况。 操作步骤 登录云监控服务管理控制台。 单击左侧导航栏的“站点监控”。 进入“站点监控”界面。 系统展示用户当前所有站点概况。包括站点名称、站点地址、探测类型、监控频率、可用探测点百分比、平均响应时间等。 单击站点名称所在行的“查看监控图表”。
监控插件实现硬件的故障风险检查时,仅会采集一些必要的系统指标用作巡检,详情见硬件监控指标采集说明。 仅支持部分Linux操作系统,详情见:Agent支持的系统有哪些?。 支持的规格:所有规格的BMS。 若实例使用自建的私有镜像作为操作系统,请确保其包含了如下软件:dmidecode、l
电商业务内存要求高、数据量大并且数据访问量大、要求快速的数据交换和处理,监控要求极其高。 ECS为核心服务,全面、立体的ECS监控系统对业务稳定起到了至关重要的作用。主机监控功能可提供服务器的系统级、主动式、细颗粒度监控服务。为业务的顺畅运行保驾护航。 网站为电商平台的入口,双12、618等大型购物节会
目前支持Linux操作系统和Windows操作系统。支持的系统请参见Agent支持的系统有哪些? 建议用户使用主机监控的主机规格为:Linux使用“2vCPUs | 4GiB”、Windows使用“4vCPUs | 8GiB”或更高配置。 Linux操作系统安装插件需要root权
获取安装命令: 选择操作系统:选择需要安装Agent的主机资源的操作系统类型。 选择安装方式:选择“单台安装”。 复制安装命令:单击安装命令后的,复制生成的安装命令。 登录主机。 主机资源操作系统为Linux时,登录方式请参考Linux ECS登录方式概述,主机资源操作系统为Windows时,登录方式请参见Windows
搭建业务的系统级监控。 本文介绍云监控服务常用最佳实践,帮助您更好的使用云监控服务。 表1 常用最佳实践 实践 描述 电商平台 电商平台最佳实践 电商业务对内存要求高、数据量大并且数据访问量大、要求快速的数据交换和处理,监控要求极其高。 主机监控功能可提供服务器的系统级、主动式、细颗粒度监控服务。
扩展应用系统对外的服务能力,通过消除单点故障提升应用系统的可用性,并且使用云监控的事件监控功能对服务器运行异常及自动恢复进行监控,订阅事件告警同步进行业务处理。 表1 ECS重点事件 事件名称 事件说明 处理步骤 因硬件故障触发重启 弹性云服务器所在的主机出现故障时,系统会自动将