主题
运维监控系统实战笔记
共 32 讲。
目录
- 运维监控系统实战笔记
- 旅程再启-运维监控的新思考与实践
- 加餐-对比理解监控和可观测性
- 加餐-两个时代的王者,Zabbix 和 Prometheus 设计对比
- 加餐-Exporter 生态太过零散,如何整合?
- 加餐-轻量级事件监控工具,一种实用的监控思路
- 加餐-众多零散的监控、可观测性系统,如何整合?
- 开篇词-每个关注高可用的人,都应该了解监控知识
- 01-背景信息:监控需求以及开源方案的横评对比
- 02-基本概念:监控圈子有哪些行业黑话?
- 03-架构概述:一个监控系统的典型架构是什么样的?
- 04-如何快速搭建Prometheus系统?
- 05-Prometheus中有哪些关键设计?
- 06-PromQL有哪些常见的使用场景?
- 07-如何解决Prometheus的存储容量问题?
- 08-如何用 Nightingale 解决 Prometheus 的告警管理问题?
- 09-监控概论(上):有哪些方法可以指导监控数据采集?
- 10-监控概论(下):监控数据的采集方式及原理
- 11-机器监控:操作系统有哪些指标需要重点关注?
- 12-网络监控:如何监控网络链路和网络设备?
- 13-组件监控:MySQL的关键指标及采集方法有哪些?
- 14-组件监控:Redis的关键指标及采集方法有哪些?
- 15-组件监控:Kafka的关键指标及采集方法有哪些?
- 16-组件监控:Elasticsearch的关键指标及采集方法有哪些?
- 17-组件监控:Kubernetes Node组件的关键指标与数据采集
- 18-组件监控:Kubernetes 控制面组件的关键指标与数据采集
- 19-应用监控:如何使用埋点方式对应用监控?
- 20-应用监控:如何使用日志来监控应用?
- 21-事件管理(上):事件降噪的几个典型手段
- 22-事件管理(下):如何保证事件的闭环处理?
- 结束语-弱水三千,只取一瓢饮
- 结课测验-来赴一场满分之约!