监控与性能优化
监控搭建、日志、告警、压测与服务器性能调优
- 服务器监控入门:该看哪些指标
用几条基础命令看懂 CPU、内存、磁盘、网络和进程,判断你的服务器是否健康。
- 用 Prometheus + Grafana 搭建服务器监控
用 Docker Compose 在你的服务器上快速起一套 Prometheus 拉取指标、Grafana 出图的监控栈,并用 node_exporter 采集主机指标。
- 用 node_exporter 采集主机指标
在你的服务器上装 node_exporter,把 CPU、内存、磁盘、网络等主机指标暴露给 Prometheus 抓取。
- 可用性监控与告警:掉线/宕机第一时间知道
用外部探测 + Uptime Kuma 或 Alertmanager,给服务器装上「心跳」,让邮件和 Telegram 替你盯着机器。
- 日志管理与查看:journald、logrotate、集中日志
用 journalctl 快速定位问题,用 logrotate 防止日志撑爆磁盘,并了解何时该上集中日志。
- 高负载排查:定位 CPU / 内存 / IO 瓶颈
服务器变慢或告警时,按"先看哪类资源满"的顺序,用 top、free、iostat、ss 一步步定位瓶颈。
- 服务器性能测试与压测:sysbench、ab、wrk
用 sysbench 摸清 CPU/内存/磁盘底子,用 ab 和 wrk 压出 HTTP 服务的 QPS 与延迟。
- 磁盘 IO 性能与优化
用 iostat、iotop、fio 判断磁盘是不是瓶颈,并通过文件系统、挂载参数与写入模式的调整把 IO 性能榨出来。
- 网络性能测试:用 iperf 评估带宽与延迟
用 iperf3、ping 和 speedtest-cli 分别测出服务器的吞吐、延迟与公网速率,读懂带宽、延迟、丢包对体验的真实影响。
- 服务器性能调优清单
一份可落地的 Linux 服务器调优 checklist:先监控找瓶颈,再逐项开 BBR、调 sysctl 与 ulimit、优化 Nginx 与数据库、加缓存与 CDN,并逐一验证效果。