本节介绍如何对 KubeSphere 资源或告警执行 AI 诊断。

前提条件

  • KubeSphere 平台已安装并启用 KubeSphere Copilot 扩展组件。

  • 目标集群已安装 Agent,且管理员已配置可用的大模型。

  • 当前用户具有目标资源以及相关事件、日志和指标的访问权限。

  • 当前资源页面支持 AI 诊断。

支持范围

类型 支持的对象

集群资源

集群节点

工作负载

部署、有状态副本集、守护进程集、任务、定时任务

容器组

容器组

告警

指标告警、事件告警

实际支持范围取决于 KubeSphere Copilot 的安装版本和管理员配置。

操作步骤

  1. 登录 KubeSphere Web 控制台,进入支持 AI 诊断的资源列表页或详情页。

  2. 在页面中找到需要诊断的资源或告警。

  3. 对目标资源执行 AI 诊断

  4. 等待 Copilot 收集当前可用的资源配置、状态、事件、日志和指标信息并完成分析。

  5. 查看诊断结果中的证据、结论和建议。

  6. 核对证据中的集群、命名空间、资源名称、时间范围和资源状态是否与当前环境一致。

  7. 在执行诊断建议前,确认建议的目标范围、所需权限、潜在影响和回滚方式。

操作结果

AI 助手显示针对目标资源或告警的诊断证据、分析结论和处理建议。

核对诊断结果

内容 核对方法

证据

确认资源名称、命名空间、时间范围、状态、事件、日志和指标来自正确的目标,并与资源当前状态一致。

结论

确认结论有相应证据支持,区分已经确认的事实和仍需验证的推测。

建议

确认操作对象、作用范围、前提条件和风险;涉及资源修改时,提前准备回滚方式。

说明

  • AI 诊断与划词问不同。AI 诊断会尝试结合目标资源的多类信息进行分析,划词问仅将选中文字作为直接上下文。

  • 诊断结果可能不完整或不准确,不能替代具备相应权限和经验的人员进行判断。

  • 无法确认建议影响时,请不要执行写操作。可要求 AI 助手补充证据,或仅提供只读排查步骤。