策略配置 策略配置是统一配置通知渠道,支持按 Agent 绑定生效,实现巡检通知、策略执行与处置闭环协同。 产品能力 自然语言运维查询 :用户可以通过自然语言向系统提问,快速查询和分析指标、日志、事件、告警等多维度运行数据。SREAgent可将复杂的可观测数据转化为清晰结论,降低查询门槛,提升日常排查效率。
日志概述 日志中心是容器引擎 CCE 基于百度智能云 日志服务 BLS 提供的 Kubernetes 集群内日志采集方案,可以将集群内服务或集群节点路径文件的日志信息推送至日志服务,进行持久化存储和日志查询分析。当集群发生故障后,您也可以从日志服务中查看历史日志信息并进行故障排查。 说明: 容器服务的日志功能基于百度智能云日志服务产品实现,日志服务产品的详细介绍,请参见 什么是日志服务 。
将诊断报告发送至飞书群 第 2 轮:深入追问 如果首轮分析显示 OOMKilled,可以继续追问: Plain Text 复制 1 帮我看看这个 Pod 是什么原因导致的 OOM? SREAgent 会进一步查询指标和请求日志,定位内存泄漏或大请求量导致的 OOM。 场景二:通过飞书机器人入口进行故障诊断 SREAgent 绑定飞书机器人后,支持通过飞书机器人入口进行故障诊断。
介绍 百度智能云容器引擎(Cloud Container Engine,即CCE)是高度可扩展的高性能容器管理服务,您可以在托管的云服务器实例集群上轻松运行应用程序。使用CCE,您将无需安装、运维、扩展您的集群管理基础设施,只需进行简单的API调用,便可启动和停止Docker应用程序,查询集群的完整状态,以及使用各种云服务。
) 元/分钟 元/小时 2 核 4GB 0.01 0.6 4 核 8GB 0.0188 1.13 8 核 16GB 0.0372 2.23 16 核 32GB 0.0673 4.04 节点数 实例规格(CPU/内存) 元/分钟 元/小时 3 4 核 8GB 0.1097 6.58 3 8 核 16GB
每天最多执行自愈操作节点个数,数据类型为整数,默认为 10; 每小时最大节点数:每小时最多执行自愈操作节点个数,数据类型为整数,默认为 3; 并发节点数:同时执行自愈操作节点个数,数据类型为整数,默认为 1, 暂不支持修改 ; 冷却时间:同一节点自愈结束后再次执行自愈操作时间间隔,数据类型为整数,单位为 分钟 ,默认为 10; Access/Secret Key:当用户选择包含 重启服务器 的自愈条件时
kubeVersion String 否 Body 参数 K8S 版本。为空时,后台会自动查询集群 K8S 版本号。
1603264688209/#/ticket/create 工单中需提供的信息: 地域名:如北京、广州、苏州、保定、香港、武汉等 集群 ID (如有):为失败信息中的 clusterID,如 c-xxxxxxx、cce-xxxxxxxx, 问题所属产品非【容器引擎 CCE】时请勿提供 CCE 节点 ID (如有):为失败信息中的 cceInstanceID,如 cce-xxxxxxxx-xxxxxxxx
Pod 的网络错误事件记录在 Pod 对象的 Events 中,可以通过 kubectl describe pod {podName} 查询。执行前请确保已获取可访问 CCE 集群的 kubeconfig ,并使用真实的 {podName} 替换示例值。 1.1 CNI 错误 CNI 错误是指在单机创建 Pod 时,容器网络组件无法正常创建 Pod 的网络资源。
i 查看审计日志 导航路径: 集群管理->集群列表->目标集群->安全管理->集群审计->全局检索 在 【集群审计】 页面切换到 【全局检索】 页签,保持默认日志集和时间范围,单击 【查询】 ,查看查询日志条数、可用字段与原始日志列表,确认审计日志可正常检索与查看。