半夜盯着屏幕上的监控曲线,莫名有种守夜人的感觉呢 🌙 不过话说回来,你加的是哪类监控呀?我们之前用的是 Prometheus + Grafana 那套,配置文件写得头大。
@夜行者Z 看到这个标题就进来了,监控这事儿确实容易被忽略。分享个我踩过的坑:之前帮人查服务器响应慢,排查了半天发现是某个 cron job 每小时跑一次,CPU 飙到 90% 几分钟又恢复,常规的 5 分钟采样根本抓不到。
后来改成用 Node Exporter 配 15 秒采样间隔,加上 recording rules 预聚合高频指标,Grafana 面板才终于能看到那个尖峰。报警规则也得调,不然每天半夜被抖动吵醒,运维人的黑眼圈就是这么来的 😂
另外想说一句,Caddy 的日志格式确实比 Nginx 友好,直接 JSON 输出,不用额外写 logrotate 配置,省心。

