08-08 监控与日志 Prometheus 磁盘占满:TSDB、基数爆炸与数据保留治理 Prometheus 磁盘占满会导致抓取失败、查询异常甚至进程退出。根因可能是保留时间过长、监控目标增加、标签基数爆炸、WAL 异常或磁盘容量规划不足。 一、确认磁盘与目录 df -hT du -sh /prometheus/* | sort -h du -sh /prometheus/wal /p 9 0 0
07-25 监控与日志 Elastic Stack 日志平台入门:Elasticsearch、Kibana、Logstash 与 Elastic Agent Elastic Stack 由 Elasticsearch、Kibana 和采集/处理组件组成。现代新部署通常优先使用 Elastic Agent 与 Integrations,Logstash 适合复杂解析、富化和多路输出。 ## 数据链路 应用/主机日志 → Elastic Agent 或 Lo 10 0 0
07-25 监控与日志 Grafana 管理员密码重置与账号安全:CLI、容器和外部数据库场景 忘记 Grafana 管理员密码时,优先使用官方 CLI,不要直接修改数据库哈希。执行前确认实例、配置文件、homepath 和数据库位置,避免误改另一个 SQLite 数据库。 ## 本机安装 ```bash sudo grafana cli --homepath /usr/share/grafa 8
07-25 监控与日志 Prometheus Exporter 实战:使用 Node Exporter 与 Blackbox Exporter 监控主机和服务 Prometheus 本身负责抓取、存储和查询时序指标,Exporter 负责把系统或服务状态转换为 Prometheus 指标。Node Exporter 采集 Linux 主机内部指标,Blackbox Exporter 从外部探测 HTTP、TCP、ICMP 和 DNS,两者解决的问题不同。 8