排序
K8s 运维系列 | 第 20 天:服务网格——Istio 入门与流量管理
引言 随着微服务架构在生产环境的深入落地,服务之间的调用关系变得日益复杂。当我们把一个个单体应用拆分成几十上百个微服务之后,服务间的通信、流量控制、安全认证、可观测性等一系列问题接...
K8s 运维系列 | 第 11 天:权限安全——RBAC 与 ServiceAccount
引言 在 Kubernetes 集群中,随着业务规模不断扩大,越来越多的人和程序需要访问集群资源。有人需要部署应用、有人需要查看日志、有人只需要读取监控指标,而自动化流水线(CI/CD)也需要调用 A...
K8s 运维系列 | 第 12 天:证书与多集群——kubeconfig 与集群切换
在生产环境里,运维人员很少只面对一个 Kubernetes 集群。开发、测试、预发、生产,再加上不同机房或云厂商的集群,少则两三个,多则十几个。面对这么多集群,如何安全地保存访问凭证、如何在它...
K8s 运维系列 | 第 16 天:工作负载进阶——StatefulSet、DaemonSet 与 Job
在前面的文章中,我们重点学习了 Kubernetes 中最常见的无状态工作负载 Deployment,它凭借 ReplicaSet 与滚动更新机制,成为了绝大多数 Web 应用部署的首选。然而真实的生产环境远比'无状态服...
K8s 运维系列 | 第 10 天:网络模型——CNI、Calico 与 NetworkPolicy
在 Kubernetes 集群中,网络是最容易被忽视、却最容易出问题的部分。前面我们部署了 Pod、Service 和 Ingress,但你是否想过:一个 Pod 如何与另一个 Pod 通信?Service 的 ClusterIP 为什么能...
K8s 运维系列 | 第 13 天:日志体系——Loki 与 EFK 日志采集分析
在 Kubernetes 集群中,Pod 随时可能被调度、重启或销毁,容器产生的日志如果只保存在本地文件里,会随着容器的生命周期一起消失。当线上出现故障时,运维人员往往需要在成百上千个 Pod 之间来...
K8s 运维系列 | 第 14 天:监控告警——Prometheus 与 Grafana 监控集群
Kubernetes 集群一旦投入生产,规模会迅速膨胀:成百上千的 Pod、分布在多台节点上的 Service、频繁变动的 Deployment,都让「集群是否健康」成为一个必须回答的问题。单纯靠 kubectl get 手工...
K8s 运维系列 | 第 18 天:存储进阶——CSI、动态供给与备份恢复
在前一篇《第 7 天:存储管理——PV、PVC 与持久化存储》中,我们学习了 PV 和 PVC 的基本用法,那套'管理员手动创建 PV、用户声明 PVC'的静态供给模式,对于生产环境来说效率太低。随着集群规...
K8s 运维系列 | 第 21 天:安全加固——Pod Security 与准入控制
安全是 Kubernetes 生产环境的核心命题。默认配置下,集群允许 Pod 以 root 身份运行、挂载宿主机文件、共享进程命名空间,这些能力一旦被恶意镜像利用,攻击者就能横向移动、逃逸到宿主机,甚...
K8s 运维系列 | 第 22 天:可观测性——Metrics、Tracing 与事件体系
引言 在 Kubernetes 上运行微服务时,系统的复杂度和动态性会急剧上升。Pod 随时可能被重建、节点会漂移、服务依赖关系变化频繁。在这种情况下,传统的'登录机器看日志'的运维方式已经力不从心...



