🗃️ Prometheus
3 items
🗃️ cAdvisor
3 items
📄️ LoongCollector:新一代高性能可观测数据采集器
本文详细介绍 LoongCollector——阿里巴巴开源的新一代高性能可观测数据采集器。内容涵盖 LoongCollector 的诞生背景、核心特性、整体架构设计、各类插件(输入、处理、聚合、输出)的功能说明,以及日志采集、容器标准输出、正则解析、Kafka 输出等典型使用示例,帮助读者快速理解并上手这款兼具极致性能与灵活可编程性的 All-in-One 采集 Agent。
📄️ Grafana Alloy:统一可观测性数据采集器
全面介绍 Grafana Alloy 开源遥测数据采集器:涵盖其设计背景与核心优势、基于有向无环图的组件化架构、Alloy 配置语言语法、集群与高可用机制、模块化复用能力,以及在 Docker、Kubernetes 等环境下的安装与配置实践,帮助读者系统理解并快速上手这款统一的可观测性数据采集工具。
📄️ Node Exporter:节点监控指标与 Label 说明
系统介绍 Node Exporter 常用主机指标,覆盖 CPU、磁盘、文件系统、内存、网络、InfiniBand、Ethtool、Textfile、电源、温控和采集器自身指标,并逐项说明指标 Label。
📄️ cAdvisor:容器资源指标与 Label 说明
系统介绍 cAdvisor 暴露的容器 CPU、内存、文件系统、网络、进程、规格和机器级资源指标,并逐项说明指标 Label。
📄️ kube-state-metrics:Kubernetes 对象状态指标与 Label 说明
系统介绍 kube-state-metrics 的 Node、PV、PVC、Pod、容器和 Pod 状态指标,并逐项说明所有可确认 Label。
📄️ Kubernetes 内部组件指标:API Server、Kubelet 与运行时 Label 说明
系统介绍 Kubernetes 内部组件常见指标,覆盖 API Server、认证授权、Kubelet、client-go、Go 运行时、进程和 workqueue,并逐项说明指标 Label。
📄️ Node Problem Detector:Kubernetes 节点问题检测与上报
本文详细介绍 Node Problem Detector(NPD)—— Kubernetes 官方提供的节点问题检测守护进程。内容涵盖 NPD 的背景与设计目标、核心架构(Problem Daemon 与 Exporter)、系统日志监控、系统状态监控、自定义插件监控及健康检查器四类问题守护进程的配置格式与使用方式,并通过完整的 DaemonSet 部署示例和 ConfigMap 配置演示,帮助读者快速在 Kubernetes 集群中部署和使用 NPD,实现节点级异常的自动上报与可见化。
📄️ Linux中进程内存及cgroup内存统计差异
深入分析 Linux 系统中进程内存和 cgroup 内存统计的差异,帮助用户理解容器环境下的内存管理和监控
📄️ OpenTelemetry Metrics介绍
详细介绍 OpenTelemetry Metrics 的核心概念、实现原理和最佳实践,帮助开发者更好地理解和使用 OpenTelemetry 进行应用监控
📄️ eBPF学习资料
系统性介绍 eBPF 技术的基本概念、工作原理和实践应用,帮助开发者掌握这一强大的内核观测和性能分析工具