排序
K8s 运维系列 | 第 22 天:可观测性——Metrics、Tracing 与事件体系
引言 在 Kubernetes 上运行微服务时,系统的复杂度和动态性会急剧上升。Pod 随时可能被重建、节点会漂移、服务依赖关系变化频繁。在这种情况下,传统的'登录机器看日志'的运维方式已经力不从心...
K8s 运维系列 | 第 21 天:安全加固——Pod Security 与准入控制
安全是 Kubernetes 生产环境的核心命题。默认配置下,集群允许 Pod 以 root 身份运行、挂载宿主机文件、共享进程命名空间,这些能力一旦被恶意镜像利用,攻击者就能横向移动、逃逸到宿主机,甚...
K8s 运维系列 | 第 8 天:调度机制——节点选择、污点与容忍度
在 Kubernetes 集群中,我们很少直接指定某个 Pod 运行在哪一台物理节点上。相反,kube-scheduler 这个核心组件会根据资源、策略与约束条件,自动为每一个 Pod 挑选一个合适的节点。理解调度机...
K8s 运维系列 | 第 5 天:Service 与 Ingress——服务发现与流量接入
在 Kubernetes 的世界里,Pod 是脆弱的、临时的、会被频繁重建的。每次 Deployment 滚动更新、节点故障、甚至一次简单的扩容,Pod 的 IP 地址都可能发生变化。如果业务系统直接依赖 Pod IP 来通...
K8s 运维系列 | 第 6 天:配置管理——ConfigMap 与 Secret 实战
在 Kubernetes 的世界里,有一条非常经典的原则:镜像只负责承载代码,配置与密钥必须与镜像解耦。如果每次修改一个数据库地址、一个环境变量都要重新构建镜像、重新推送仓库、再滚动发布,那这...
K8s 运维系列 | 第 7 天:存储管理——PV、PVC 与持久化存储
容器天生是「无状态」的,一旦 Pod 被销毁或重建,容器内部写入的文件都会随之消失。但在真实的业务场景中,数据库、消息队列、日志系统、文件上传服务等应用,都必须把数据持久地保存下来,即...
K8s 运维系列 | 第 9 天:资源管理——Request/Limit 与 HPA 弹性伸缩
在 Kubernetes 的世界里,集群资源永远是稀缺的。CPU、内存、存储,都是有限的算力,而集群上运行着成百上千个 Pod。如果没有一套清晰的资源管理机制,某个失控的应用可能瞬间吃掉整台节点的内...
K8s 运维系列 | 第 10 天:网络模型——CNI、Calico 与 NetworkPolicy
在 Kubernetes 集群中,网络是最容易被忽视、却最容易出问题的部分。前面我们部署了 Pod、Service 和 Ingress,但你是否想过:一个 Pod 如何与另一个 Pod 通信?Service 的 ClusterIP 为什么能...
K8s 运维系列 | 第 11 天:权限安全——RBAC 与 ServiceAccount
引言 在 Kubernetes 集群中,随着业务规模不断扩大,越来越多的人和程序需要访问集群资源。有人需要部署应用、有人需要查看日志、有人只需要读取监控指标,而自动化流水线(CI/CD)也需要调用 A...
K8s 运维系列 | 第 12 天:证书与多集群——kubeconfig 与集群切换
在生产环境里,运维人员很少只面对一个 Kubernetes 集群。开发、测试、预发、生产,再加上不同机房或云厂商的集群,少则两三个,多则十几个。面对这么多集群,如何安全地保存访问凭证、如何在它...
K8s 运维系列 | 第 13 天:日志体系——Loki 与 EFK 日志采集分析
在 Kubernetes 集群中,Pod 随时可能被调度、重启或销毁,容器产生的日志如果只保存在本地文件里,会随着容器的生命周期一起消失。当线上出现故障时,运维人员往往需要在成百上千个 Pod 之间来...
K8s 运维系列 | 第 14 天:监控告警——Prometheus 与 Grafana 监控集群
Kubernetes 集群一旦投入生产,规模会迅速膨胀:成百上千的 Pod、分布在多台节点上的 Service、频繁变动的 Deployment,都让「集群是否健康」成为一个必须回答的问题。单纯靠 kubectl get 手工...



