检测到您已登录华为云国际站账号,为了您更好的体验,建议您访问国际站服务网站 https://www.huaweicloud.com/intl/zh-cn
不再显示此消息
故障管理常见问题 生成事件的流程是什么? 怎么能收到事件单通知? Warroom是什么?
演练报告有哪些内容?
批量RDS操作 批量开启 批量停止 批量重启 父主题: 资源批量操作
批量FlexusL操作 批量开机 批量关机 批量重启 批量重装操作系统 批量切换操作系统 父主题: 资源批量操作
创建脚本 功能介绍 创建作业脚本:自定义脚本 脚本有标签属性,表示是高危脚本。创建时候不需要对脚本进行是否是高危的二次校验。
约束与限制 更详细的限制请参见具体API的说明。 父主题: 使用前必读
事件管理 创建事件单 受理事件单 提交事件单解决方案 验证事件处理结果 查询事件单详情 事件相关枚举信息 父主题: 故障管理
创建排班 使用场景 事件、变更等场景需获取排班中的人员作为责任人,可通过创建排班场景及角色进行人员管理。 操作步骤 登录COC。 在左侧导航栏选择“基础配置 > 排班管理”页面,单击右上角的“创建排班”。 图1 排班管理页面 进入“创建排班”页面,可以填写排班场景信息,并添加排班角色后单击
改进单历史记录 登录云运维中心。 在左侧导航栏选择“故障管理 > 改进管理”。 在“待处理的”页签,选择需要验证的改进单,单击改进单标题。 单击上方“改进历史”。 查看改进单历史记录。 父主题: 改进管理
创建问题 登录云运维中心。 在左侧导航栏选择“故障管理 > 问题管理”。 单击右上方“创建问题单”。 设置“创建问题单”。 表1 创建问题单参数说明 参数 说明 问题标题 自定义问题的标题。 问题描述 对问题进行描述,具体描述问题现象和对现网的影响。
演练报告 操作场景 演练报告包含创建、编辑、改进事项以及故障记录的查看,以便用户全面地记录和管理演练活动及其结果。 创建演练报告 演练结束后可以创建演练报告 登录COC。 在左侧菜单栏选择“韧性中心 > 混沌演练”页面,选择“演练任务”页签,查看演练任务列表。 图1 演练任务列表
创建事件 操作场景 云运维中心提供了多种方式生成事件来记录故障。如果汇聚告警工单转事件和原始告警触发自动生成事件两种被动生成事件的方式不满足您的业务需求,您还可以通过手动创建事件功能来记录。 前提条件 需要先在应用管理中创建您的应用。
表2 添加新的攻击任务参数说明 参数 说明 示例 云厂商 请选择云厂商类型。 华为云 攻击目标来源 请选择目标实例的来源。 云容器引擎 (CCE)支持通过选择实例、指定pod、指定数量方式选择攻击目标。 弹性云服务器(ECS) 攻击任务名称 根据命名规则,自定义攻击任务的名称。
启用、禁用集成 登录云运维中心。 在左侧导航栏选择“故障管理 > 集成管理”。 单击监控源的“启用/禁用”。 对接入源进行启用或者禁用操作。 更新集成标识 登录云运维中心。 在左侧导航栏选择“故障管理 > 集成管理”。 单击需要更新的监控源。 单击下方集成标识右侧。
选择是否有应急预案。如果选择是,请输入应急预案名称搜索,选择对应的应急预案,如果没有合适的应急预案 可以选择直接创建一个应急预案,单击“完成配置”即可创建故障模式。 如选择优秀故障模式可以进行克隆操作创建故障模式。
2、组织成员账号已开通云运维中心COC服务。 操作场景 云运维中心提供运维态势感知的能力,包含变更、事件、告警、安全合规、SLO(服务级别目标)、PRR(生产准备度评估)等多种运维指标数据,从宏观到微观全面呈现运维全局态势,提供企业级运维沙盘。
批量BMS操作 批量开机 批量关机 批量重启 批量重装操作系统 父主题: 资源批量操作
变更管理常见问题 常规变更&紧急变更的区别? 变更级别的定义?
验证问题 登录云运维中心。 在左侧导航栏选择“故障管理 > 问题管理”。 在“待我处理”页签,选择需要处理的问题单,单击问题单标题。 单击右上方“验证”。 设置“验证”。 是否通过:可选项“通过”、“不通过”。 验证描述:填写验证描述。限制长度0-300个字符。 单击“确定”。
转发事件 登录云运维中心。 在左侧导航栏选择“故障管理 > 事件管理”。 在“待处理的”页签,选择需要处理的事件单,单击事件标题。 单击右上方“转发责任人”。 设置“转发责任人”。 表1 转发责任人参数说明 参数 说明 转发责任人 可选项“排班”、“个人”。