Prometheus 第2页
DevOps全链路实战 | 第 13 天:告警规则与 Alertmanager 钉钉/邮件通知渠道配置 - 恒星

DevOps全链路实战 | 第 13 天:告警规则与 Alertmanager 钉钉/邮件通知渠道配置

第 13/19 天 引言 在前两天的内容中,我们已经完成了 Prometheus 指标采集和 Grafana 可视化看板的搭建。监控数据再丰富,如果没有人去看,也只是一堆沉睡的数字。真正的'可观测性'闭环,必须包...
小 刚的头像 - 恒星小 刚5天前
030
DevOps全链路实战 | 第 16 天:AnalysisTemplate 指标分析与自动回滚机制 - 恒星

DevOps全链路实战 | 第 16 天:AnalysisTemplate 指标分析与自动回滚机制

第 16/19 天 引言:让发布拥有'自动驾驶'能力 在上一篇文章《金丝雀发布实战》中,我们通过 setWeight 与 pause 步骤实现了流量分割的渐进式发布。但这种模式有一个明显短板——所有决策都依赖...
小 刚的头像 - 恒星小 刚2天前
030
Ceph 生产环境搭建 | 第 5 天:Manager 节点部署与模块启用 - 恒星

Ceph 生产环境搭建 | 第 5 天:Manager 节点部署与模块启用

第 5/20 天 · Ceph 生产环境搭建系列 引言:Manager 在 Ceph 集群中的定位 在前四天的内容里,我们已经完成了 Ceph 架构选型、Ubuntu 系统调优、cephadm 引导初始化以及 Monitor 节点的高可用...
小 刚的头像 - 恒星小 刚10天前
030
K8s 运维系列 | 第 14 天:监控告警——Prometheus 与 Grafana 监控集群 - 恒星

K8s 运维系列 | 第 14 天:监控告警——Prometheus 与 Grafana 监控集群

Kubernetes 集群一旦投入生产,规模会迅速膨胀:成百上千的 Pod、分布在多台节点上的 Service、频繁变动的 Deployment,都让「集群是否健康」成为一个必须回答的问题。单纯靠 kubectl get 手工...
DevOps全链路实战 | 第 2 天:K8s 集群与网络基础:kubeadm 离线部署与 Cilium 网络插件 - 恒星

DevOps全链路实战 | 第 2 天:K8s 集群与网络基础:kubeadm 离线部署与 Cilium 网络插件

第 2/18 天 引言 在第 1 天,我们把「从代码提交到灰度发布」的完整 DevOps 管道蓝图摊在了桌面上:Git 仓库、CI 流水线、镜像仓库、GitOps 控制器、可观测性组件、渐进式交付控制器——这些子...
小 刚的头像 - 恒星小 刚16天前
030
DevOps全链路实战 | 第 14 天:Argo Rollouts 安装与基础概念:CRD 与 Rollout 资源定义 - 恒星

DevOps全链路实战 | 第 14 天:Argo Rollouts 安装与基础概念:CRD 与 Rollout 资源定义

第 14/19 天 引言 在前 13 天的系列文章中,我们已经完成了从 Harbor 镜像仓库、GitLab CI 流水线、SonarQube 代码质量检查,到 Argo CD GitOps 持续部署,再到 Prometheus/Grafana 可观测性与 ...
小 刚的头像 - 恒星小 刚4天前
020
DevOps全链路实战 | 第 15 天:金丝雀发布实战:setWeight 流量分割与 pause 步骤 - 恒星

DevOps全链路实战 | 第 15 天:金丝雀发布实战:setWeight 流量分割与 pause 步骤

第 15/19 天。在上一篇中我们完成了 Argo Rollouts 的安装与 CRD 概念解析,理解了 Rollout 资源如何替代原生 Deployment 实现金丝雀、蓝绿等高级发布策略。今天我们进入实战环节——动手配置一...
小 刚的头像 - 恒星小 刚3天前
020
DevOps全链路实战 | 第 17 天:全链路端到端演示:代码提交→构建→代码检查→灰度→监控→告警完整流程 - 恒星

DevOps全链路实战 | 第 17 天:全链路端到端演示:代码提交→构建→代码检查→灰度→监控→告警完整流程

第 17/19 天 引言:把所有齿轮咬合在一起 经过前 16 天的逐层搭建,我们已经拥有了 Harbor 私有镜像仓库、GitLab 代码托管平台与 CI 流水线、SonarQube 代码质量门禁、Argo CD GitOps 引擎、Pro...
小 刚的头像 - 恒星小 刚前天
020
Ceph+K8s 中间件实战 | 第 15 天:K8s 中间件统一监控与运维巡检总结(Prometheus + Grafana 全景) - 恒星

Ceph+K8s 中间件实战 | 第 15 天:K8s 中间件统一监控与运维巡检总结(Prometheus + Grafana 全景)

第 15/15 天 — 系列收官篇 经过前 14 天的持续实战,我们已经在 Ceph RBD/FS 持久化存储之上,成功部署了 MySQL、Redis(Cluster + Sentinel)、MinIO、MongoDB、Nacos、Zookeeper、Elasticsea...
小 刚的头像 - 恒星小 刚昨天
010
Ceph 生产环境搭建 | 第 15 天:Ceph 集群监控:Prometheus + Grafana + 内置仪表盘 - 恒星

Ceph 生产环境搭建 | 第 15 天:Ceph 集群监控:Prometheus + Grafana + 内置仪表盘

第 15/20 天 在 Ceph 生产环境中,'部署完成'绝不意味着'工作完成'。一个没有监控的存储集群就像一辆没有仪表盘的汽车——你不知道油量、不知道车速、不知道引擎温度,直到某天突然抛锚。前 14 ...
小 刚的头像 - 恒星小 刚20小时前
010
DevOps全链路实战 | 第 18 天:生产化加固要点:Harbor/GitLab/Argo CD/SonarQube 高可用方案 - 恒星

DevOps全链路实战 | 第 18 天:生产化加固要点:Harbor/GitLab/Argo CD/SonarQube 高可用方案

第 18/19 天 引言:从'能跑'到'扛得住'的距离 走过前面十七天,我们的 DevOps 管道已经能完成「代码提交 → 构建 → 静态检查 → GitOps 部署 → 灰度 → 监控 → 告警」的完整闭环。但如果你把...
小 刚的头像 - 恒星小 刚22小时前
000