Skip to content

集群管理

集群管理用于查看和维护 Kubernetes 集群本身。这里关注的重点不是某一个应用,而是整个运行环境是否正常、节点是否健康、资源是否够用,以及集群里的关键对象是否处于正确状态。

在当前面板里,集群管理相关的常见页面包括:

  • 概览
  • 节点管理
  • 镜像管理
  • 资源对象浏览器

此外,在实际使用过程中,你还可能进入一些与集群排查相关的子页面,例如原始查询、节点文件管理等入口。

进入集群管理

  1. 登录微擎面板。
  2. 在左侧菜单进入 集群管理
  3. 根据当前问题进入 概览节点管理镜像管理资源对象浏览器

如果你不确定问题在不在应用本身,通常就应该先回到集群管理确认整体状态。

查看概览

概览 页更适合做快速判断。

进入后,建议优先查看:

  • CPU、内存、磁盘等资源是否紧张
  • 节点数量和状态是否正常
  • 应用、域名、存储分区等关键数量是否符合预期
  • 集群整体是否存在明显异常

什么情况下先看概览

如果你遇到下面这些情况,通常应先看 概览

  • 多个应用同时异常
  • 页面整体变慢
  • 应用调度异常
  • 怀疑集群资源不足

概览页的作用不是处理细节,而是先判断“问题大不大、范围广不广、是不是资源层异常”。

节点管理

节点管理 用于查看各个节点的运行情况,并处理节点级操作。

查看节点列表

  1. 进入 集群管理节点管理
  2. 查看节点列表。
  3. 重点关注节点状态、IP、资源占用和调度情况。

节点管理里的常见操作

节点页常见操作通常包括:

  • 注册节点:把新节点加入集群
  • 修改镜像源:调整节点拉取镜像时使用的镜像源
  • 封锁节点:阻止新 Pod 调度到该节点
  • 驱逐节点:将工作负载迁移到其他节点
  • 删除节点:将节点从集群中移除
  • 节点优化类操作:如内存优化等节点级处理

什么情况下优先检查节点

如果你遇到下面这些问题,建议先回到 节点管理

  • 应用始终调度不上去
  • 节点显示 NotReady
  • 某个应用只在特定节点上异常
  • 资源使用率明显过高

这时继续只看应用详情页,通常意义不大,先确认节点是否正常更关键。

镜像管理

如果应用部署失败、镜像构建异常,或者你怀疑问题出在节点镜像侧,请直接查看:

资源对象浏览器

资源对象浏览器 适合在图形界面里直接查看 Kubernetes 原生对象。

常见查看对象

最常用的通常包括:

  • Pod:查看容器是否启动、是否重启、是否异常
  • Service:查看服务暴露方式和端口
  • ConfigMap / Secret:确认配置和密钥是否存在
  • Deployment / StatefulSet:查看工作负载是否正常更新和运行
  • Ingress:查看访问入口配置是否完整

什么情况下要用资源对象浏览器

当你发现:

  • 应用列表显示的状态和实际访问结果不一致
  • 应用部署后行为异常
  • 想确认某个资源到底有没有创建成功
  • 想直接看某个 Kubernetes 对象的真实状态

这时候 资源对象浏览器 通常是最直接的排查入口之一。

原始查询和更深入的排查

当图形列表还不够用时,你可能还会进入更底层的排查入口,例如:

  • 原始查询:直接查看更原始的资源信息
  • 集群相关的终端或命令执行能力
  • 节点文件管理等辅助排查入口

这些入口更适合“已经知道要查什么”的场景,而不是第一次排查时的首选入口。

发生问题时先看哪里

通常可以按这个顺序判断:

  1. 先看概览:资源和整体状态是否异常
  2. 再看节点管理:节点是否在线、资源是否足够
  3. 再看镜像管理:镜像侧是否准备正常
  4. 再看资源对象浏览器:Pod、Service、Ingress、ConfigMap 是否正确
  5. 必要时进入更底层排查入口:继续确认真实状态

这个顺序的好处是,先排大问题,再查细节,不容易一开始就陷进某个具体对象里。

什么时候说明问题已经不是应用层了

如果你发现下面这些情况,通常说明问题可能已经不只是某个应用本身:

  • 节点状态异常
  • 资源使用率明显过高
  • 同一批应用同时异常
  • 镜像准备或拉取存在问题
  • Service 或 Ingress 本身状态不正常
  • 集群内部访问链路不通

这时更应该回到集群管理做整体排查,而不是继续只盯着某一个应用。

集群管理的作用,不是替代 Kubernetes,而是帮你更快判断环境是否健康、问题大概出在哪一层,以及下一步应该去哪里继续处理。