搜索_华为云

低版本内核的CentOS节点出现容器OOM时，偶现ext4文件系统卡死问题 - 云容器引擎 CCE

问题根因业务容器内存使用超过容器的内存限制量时，触发cgroup OOM，被系统内核终止。容器cgroup OOM在CentOS 7会偶现触发ext4文件系统卡死，ext4/jbd2会因为死锁而永远挂起。在文件系统上执行I/O的所有任务都将受到影响。解决方法临时解决方案：该问题触发后可以通过重启节点临时恢复。

帮助中心 > 云容器引擎 CCE > 常见问题 > 节点 > 操作系统问题说明
低版本内核的CentOS节点反复创删应用时偶现cgroup kmem泄露问题 - 云容器引擎 CCE

17集群版本已停止维护，修复该问题建议升级至1.19及以上集群版本，并通过节点重置为最新版本的操作系统修复该问题，确保内核版本高于3.10.0-1062.12.1.el7.x86_64。父主题：操作系统问题说明

 帮助中心 > 云容器引擎 CCE > 常见问题 > 节点 > 操作系统问题说明
通过AOM配置自定义告警 - 云容器引擎 CCE

根据页面提示填写基本信息后，设置告警规则。关键参数如下：详细参数说明请参见创建事件类告警规则。规则类型：选择“事件告警规则”。事件类型：选择“系统事件”。事件来源：选择“CCE”。监控对象：监控对象可以通过多个维度（通知类型、事件名称、告警级别、自定义属性、命名空间、集群名称）进行筛选，您可以根据需要选择。

帮助中心 > 云容器引擎 CCE > 用户指南 > 云原生观测 > 告警中心
通过PromQL语句查询Prometheus数据 - 云容器引擎 CCE

通过控制台获取华为云Prometheus监控数据在集群中安装云原生监控插件，采集Prometheus监控数据。登录CCE控制台，单击集群名称进入集群，单击左侧导航栏的“插件中心”。在“插件中心”页面右侧找到云原生监控插件，单击“安装”。建议您关注以下配置，其他配置可按需进行设置。详情请参见云原生监控插件。

帮助中心 > 云容器引擎 CCE > 最佳实践 > 监控
云原生监控插件兼容自建Prometheus - 云容器引擎 CCE

云原生监控插件兼容自建Prometheus 云原生监控插件兼容模式若您已自建Prometheus，且您的Prometheus基于开源，未做深度定制、未与您的监控系统深度整合，建议您卸载自建Prometheus并直接使用云原生监控插件对您的集群进行监控，无需开启“兼容模式”。卸

 帮助中心 > 云容器引擎 CCE > 用户指南 > 云原生观测 > 云原生观测最佳实践
PVC视图 - 云容器引擎 CCE
PVC视图 - 云容器引擎 CCE

提供了集群中的PVC监控视图，包含PV/PVC的状态、使用率情况。支持以下PVC类型监控：云硬盘类型的PVC（要求volumeMode参数值为Filesystem）支持使用量监控。本地持久卷类型的PVC（要求集群中安装的Everest版本大于等于2.4.41）支持使用量监控。极速文

 帮助中心 > 云容器引擎 CCE > 用户指南 > 云原生观测 > 监控中心 > 仪表盘
监控CoreDNS运行状态 - 云容器引擎 CCE

监控CoreDNS运行状态 CoreDNS通过标准的Promethues接口暴露出解析结果等健康指标，发现CoreDNS服务端甚至上游DNS服务器的异常。 CoreDNS自身metrics数据接口，默认zone侦听{$POD_IP}:9153，请保持此默认值，否则普罗无法采集coredns

帮助中心 > 云容器引擎 CCE > 最佳实践 > 网络 > CoreDNS配置优化实践 > 服务端
云原生监控插件版本发布记录 - 云容器引擎 CCE

云原生监控插件版本发布记录表1 云原生监控插件版本记录插件版本支持的集群版本更新特性社区版本 3.11.0 v1.21 v1.23 v1.25 v1.27 v1.28 v1.29 v1.30 适配CCE v1.30集群 2.37.8 3.10.1 v1.21 v1.23

帮助中心 > 云容器引擎 CCE > 服务公告 > 产品发布记录 > 插件版本发布记录
GPU视图 - 云容器引擎 CCE
GPU视图 - 云容器引擎 CCE

GPU视图 GPU资源指标可以衡量GPU性能和使用情况，包括GPU的利用率、温度、显存等方面的监控数据，帮助您掌控GPU运行状况。指标说明图1 GPU资源指标表1 GPU图表说明图表名称单位说明集群-显存使用率百分比集群的显存使用率计算公式：集群内容器显存使用总量/集群内显存总量

 帮助中心 > 云容器引擎 CCE > 用户指南 > 云原生观测 > 监控中心 > 仪表盘
Prometheus Server视图 - 云容器引擎 CCE

Prometheus本地数据存储模式可以收集有关主机和应用程序的指标数据并存储在集群中，监控数据可以选择上报并存储到AOM或三方监控平台。Prometheus Server视图展示了Prometheus提供的一些内置指标，可用于监控和度量系统的性能和状态。指标说明 Prometheus Server视图暴露的指标如下：

帮助中心 > 云容器引擎 CCE > 用户指南 > 云原生观测 > 监控中心 > 仪表盘
CCE集群纳管节点时的常见问题及排查方法？ - 云容器引擎 CCE

本文主要介绍纳管/添加已有的ECS实例到CCE集群的常见问题。纳管时，会将所选弹性云服务器的操作系统重置为CCE提供的标准镜像，以确保节点的稳定性，请选择操作系统及重置后的登录方式。所选弹性云服务器挂载的系统盘、数据盘都会在纳管时被格式化，请确保信息已备份。纳管过程中，请勿在弹性云服务器控制台对所选虚拟机做任何操作。

帮助中心 > 云容器引擎 CCE > 常见问题 > 节点 > 节点创建
使用PrometheusRules配置普罗监控与告警规则 - 云容器引擎 CCE

使用PrometheusRules配置普罗监控与告警规则 Prometheus具有PrometheusRule的能力，PrometheusRules提供了一种用于监控和警报的规则语言，能够方便用户更好的使用Prometheus查询监控指标，配置基于PromQL的告警规则。当前云原生监控插件仅支持开启本地

 帮助中心 > 云容器引擎 CCE > 用户指南 > 云原生观测 > 云原生观测最佳实践
基于ELB监控指标的弹性伸缩实践 - 云容器引擎 CCE

class 根据上一步查询到ELB实例ID，使用查询监听器接口查询监听器ID。获取ELB监控数据。 ELB的调用CES批量查询监控数据接口，查询ELB的监控数据，ELB详细的监控数据指标请参见ELB监控指标说明。例如如下几种参数 m1_cps：并发连接数 m5_in_pps：流入数据包数

 帮助中心 > 云容器引擎 CCE > 最佳实践 > 弹性伸缩
Prometheus Agent视图 - 云容器引擎 CCE

Prometheus Agent是轻量化的容器监控模式，可以收集有关主机和应用程序的指标数据，并将数据上报并存储到AOM或三方监控平台。Prometheus Agent视图展示了Prometheus提供的一些内置指标，可用于监控和度量系统的性能和状态。指标说明 Prometheus

帮助中心 > 云容器引擎 CCE > 用户指南 > 云原生观测 > 监控中心 > 仪表盘
云原生监控插件升级检查异常处理 - 云容器引擎 CCE

云原生监控插件升级检查异常处理检查项内容在集群升级过程中，云原生监控插件从3.9.0之前的版本升级至3.9.0之后的版本升级时，存在兼容性问题，需检查该插件是否开启了grafana的开关。解决方案由于云原生监控插件在3.9.0之后的版本，不再聚合grafana的能力，因此

 帮助中心 > 云容器引擎 CCE > 用户指南 > 集群 > 升级集群 > 升级前检查异常问题排查
主机视图 - 云容器引擎 CCE
主机视图 - 云容器引擎 CCE

fragMemroy：Frag缓冲区使用量。 rawInuse：正在使用的Raw套接字数量。文件系统异常 / 文件系统状态 readonly：文件系统只读 deviceError：文件系统错误磁盘读写速率次/秒磁盘每秒进行的读写次数磁盘读和写延迟（秒）秒磁盘读写时延 IO队列数

 帮助中心 > 云容器引擎 CCE > 用户指南 > 云原生观测 > 监控中心 > 仪表盘
监控NGINX Ingress控制器指标 - 云容器引擎 CCE

eus监控了哪些目标。图2 查看监控目标监控NGINX Ingress控制器指标访问Prometheus，在“Graph”页面中，查看NGINX Ingress控制器指标。图3 查看NGINX Ingress控制器监控指标表1 NGINX Ingress控制器监控指标指标

 帮助中心 > 云容器引擎 CCE > 用户指南 > 云原生观测 > 云原生观测最佳实践
基于GPU监控指标的工作负载弹性伸缩配置 - 云容器引擎 CCE

基于GPU监控指标的工作负载弹性伸缩配置集群中包含GPU节点时，可通过GPU指标查看节点GPU资源的使用情况，例如GPU利用率、显存使用量等。在获取GPU监控指标后，用户可根据应用的GPU指标配置弹性伸缩策略，在业务波动时自适应调整应用的副本数量。前提条件目标集群已创建，且

 帮助中心 > 云容器引擎 CCE > 用户指南 > 调度 > GPU调度
Pod视图 - 云容器引擎 CCE
Pod视图 - 云容器引擎 CCE

容器磁盘读写IO速率(读+写) 次数/秒容器磁盘每秒读写IO次数容器磁盘读写吞吐量(读+写) 字节/秒容器磁盘每秒读写字节数文件系统使用率百分比文件系统的使用率文件系统使用量字节文件系统已经使用的字节数指标清单 Pod视图使用的指标清单如下：表4 Pod视图指标清单指标指标类型说明

 帮助中心 > 云容器引擎 CCE > 用户指南 > 云原生观测 > 监控中心 > 仪表盘
为什么CCE集群界面的节点磁盘监控看起来不准确？ - 云容器引擎 CCE

为什么CCE集群界面的节点磁盘监控看起来不准确？问题描述： CCE集群界面的某个节点磁盘监控高达80%以上，而进入云监控界面看到的磁盘使用率在40%不到。后面在该节点上排查，发现有一个pvc磁盘使用达到了92%，将这个盘清理后，集群界面的磁盘使用率和云监控使用率一致了。请问集群界面的节点监控是怎么

 帮助中心 > 云容器引擎 CCE > 常见问题 > 集群 > 集群运行

总条数： 902

上一页
1
2
3
4
5
...
46
下一页
跳转

点击加载更多

您搜索到想要的结果了吗？

是的没搜到

意见反馈

/200

提交反馈取消

低版本内核的CentOS节点出现容器OOM时，偶现ext4文件系统卡死问题 - 云容器引擎 CCE

低版本内核的CentOS节点反复创删应用时偶现cgroup kmem泄露问题 - 云容器引擎 CCE

通过AOM配置自定义告警 - 云容器引擎 CCE

通过PromQL语句查询Prometheus数据 - 云容器引擎 CCE

云原生监控插件兼容自建Prometheus - 云容器引擎 CCE

PVC视图 - 云容器引擎 CCE

监控CoreDNS运行状态 - 云容器引擎 CCE

云原生监控插件版本发布记录 - 云容器引擎 CCE

GPU视图 - 云容器引擎 CCE

Prometheus Server视图 - 云容器引擎 CCE

CCE集群纳管节点时的常见问题及排查方法？ - 云容器引擎 CCE

使用PrometheusRules配置普罗监控与告警规则 - 云容器引擎 CCE

基于ELB监控指标的弹性伸缩实践 - 云容器引擎 CCE

Prometheus Agent视图 - 云容器引擎 CCE

云原生监控插件升级检查异常处理 - 云容器引擎 CCE

主机视图 - 云容器引擎 CCE

监控NGINX Ingress控制器指标 - 云容器引擎 CCE

基于GPU监控指标的工作负载弹性伸缩配置 - 云容器引擎 CCE

Pod视图 - 云容器引擎 CCE

为什么CCE集群界面的节点磁盘监控看起来不准确？ - 云容器引擎 CCE

意见反馈

7*24

备案

专业服务

退订

建议反馈

售前咨询热线