电话:400-650-6396  15652658866

  当前位置:   首页 > 资源中心 > 国产信创 > 【容器监控】Kubernetes监控方案(基础版)

【容器监控】Kubernetes监控方案(基础版)

  作者:监控易        来源:美信时代 发布时间:2026-07-21

本文速览 容器环境监控的新挑战| 监控范围| 采集原理| 配置步骤| 某互联网企业的K8s监控实践

核心要点摘要:随着容器化应用的普及,Kubernetes成为运维监控的新战场。监控易智能一体化运维平台支持通过Kubernetes API采集集群的基础运行数据,包括节点状态、Pod运行状况、资源使用情况等,帮助运维团队初步掌握容器环境的运行态势。 

1.png

适用读者:政府、金融、军工、能源、交通、医疗、教育等行业运维人员,云原生应用运维工程师。

一、容器环境监控的新挑战

某企业的开发测试环境迁移到Kubernetes集群后,运维团队发现传统监控工具无法直接采集容器指标:Pod是动态创建的,IP地址频繁变化,生命周期短。

容器环境监控的挑战在于:

· 动态性:Pod随时创建和销毁,监控目标需要自动发现

· 粒度细:需要监控到容器级别的资源使用

· 关联复杂:容器与宿主机、命名空间、服务之间的关联需要梳理

二、监控易Kubernetes监控范围

监控易当前支持采集以下Kubernetes资源的基础指标:

· 节点(Node):CPU使用率、内存使用率、磁盘使用率、网络流量(通过kubelet的cAdvisor接口获取)

· Pod:CPU使用率、内存使用率、重启次数、状态(Running/Pending/Failed)

· 容器(Container):CPU使用率、内存使用率

· 命名空间(Namespace):资源配额使用情况

· 工作负载(Deployment/StatefulSet):期望副本数、可用副本数、不可用副本数

注意:监控易当前版本暂不支持对Kubernetes内部组件(etcd、apiserver、scheduler)的深度监控。 

2.png

三、采集原理

监控易通过Kubernetes Metrics API和kubelet cAdvisor接口采集资源使用数据:

1. Metrics API:Kubernetes默认提供metrics.k8s.io API(需安装metrics-server)

2. cAdvisor:kubelet内置的容器监控代理

四、配置步骤

前提条件:

· Kubernetes集群已安装metrics-server

· 监控易服务器能够访问Kubernetes API Server

· 准备具有只读权限的ServiceAccount Token

第一步:获取访问凭证:在Kubernetes集群中创建监控专用的ServiceAccount并获取Token

第二步:添加Kubernetes集群设备:在监控易中,选择“设备管理”→“新增设备”,选择“容器”分类下的“Kubernetes集群”

第三步:填写连接信息:API Server地址、Token、跳过TLS验证(测试环境可选)

第四步:选择监控范围:系统自动发现集群中的节点、命名空间

第五步:配置采集频率:建议60秒 

3.png

五、监控数据展示

配置完成后,可在监控易中查看:

· 集群总览:节点数量、Pod数量、命名空间数量

· 节点列表:各节点的CPU/内存使用率、状态(Ready/NotReady)

· Pod列表:按命名空间分组,显示Pod状态、重启次数、资源使用

· 工作负载概览:Deployment的期望副本数与可用副本数

六、典型应用场景

场景一:集群资源水位监控:运维团队通过监控易查看集群总体CPU/内存使用率,接近阈值时及时扩容

场景二:Pod重启告警:配置告警规则,当Pod重启次数在1小时内超过3次时发送告警

场景三:节点异常发现:当Kubernetes节点状态变为NotReady时,监控易立即告警

场景四:资源配额监控:对于设置了ResourceQuota的命名空间,监控其配额使用率

七、客户实践:某互联网企业的K8s监控

某互联网企业的开发测试环境运行着一个30节点的Kubernetes集群:

· 通过节点监控及时发现一台节点因磁盘满导致的NotReady状态

· 配置了Pod重启告警,发现某微服务因内存限制过小频繁OOM

· 定期查看集群资源趋势,为扩容决策提供数据支撑

评价:“虽然监控易的K8s监控功能基础,但已经能满足我们日常的资源观测和告警需求。” 

4.png

八、结语

Kubernetes监控是运维团队在容器化浪潮中必须掌握的能力。监控易智能一体化运维平台提供了Kubernetes集群基础监控的支持,帮助用户快速接入容器环境的资源观测。

核心要点总结

1. 监控易通过Kubernetes Metrics API和cAdvisor采集容器资源数据

2. 需提前安装metrics-server

3. 支持节点、Pod、容器、命名空间、工作负载的基础监控

4. 暂不支持Kubernetes内部组件深度监控和自定义指标

5. 监控账户建议授予只读权限(clusterrole: view)

常见问题

Q1:监控易能否监控Kubernetes集群中的自定义指标?

A:暂不支持。监控易当前仅采集Kubernetes Metrics API提供的标准资源指标。自定义指标需通过Prometheus等工具采集。

Q2:监控Kubernetes会对集群性能产生影响吗?

A:影响很小。监控易通过API Server查询Metrics API,每分钟一次查询,对集群负载增加可忽略不计。

Q3:没有安装metrics-server可以监控吗?

A:可以监控Pod状态、节点状态、副本数等元数据,但无法获取CPU/内存资源使用率。

适用场景:开发测试环境K8s集群资源观测、生产环境容器集群基础监控、容器化应用Pod健康状态巡检

#容器监控 #Kubernetes #k8s #资源监控 #监控易智能一体化运维平台

内容责任声明

来源:监控易技术团队原创(北京美信时代科技有限公司)

作者:技术部 刘美玲

编辑:市场部 扬扬

初审:技术部 刘美玲

数据核实:技术部 刘美玲

终审:解决方案部 Dino

本文内容基于公开信创政策及实际项目经验编写,数据来源可追溯。未经授权不得转载。

 


上一篇: 【自动化运维】作业编排:将重复操作固化为自动化流程

下一篇: 【虚拟化监控】VMware/华为云资源监控实践

监控易期待与各企业展开广泛合作!

电话:400-650-6396

手机:15652658866

QQ:3592185434

邮箱:contact@jiankongyi.com

在线客服系统