磁盘写满与数据库慢查询,是中小企业服务器两类高发故障。按日、周、月三个频次拆成 6 项巡检并配好告警阈值,多数问题能在影响业务前被发现。
先说结论:磁盘使用率超过 80% 通常就该处理,不要等写满
据我们的运维经验,磁盘建议设两条线:80% 预警、90% 立即处置。 磁盘被写满后,MySQL 通常会直接停止写入,网站表现为"前台能看、后台提交失败",排查起来容易走弯路。玉晗网络(安徽安庆)在运维托管中把这两条阈值写进监控脚本,告警直接推送到企业微信。
巡检项一:磁盘空间与 inode(每日)
看两个指标,不只是剩余容量。 据我们的运维经验,小文件多的服务器通常会出现容量还剩 30%、inode 却已用尽的情况,表现同样是"无法写入"。
df -h查容量使用率。df -i查 inode 使用率。- 按目录排序找大文件:
du -sh /www/* | sort -rh | head -20。
巡检项二:MySQL 慢查询日志(每周)
开启慢查询日志,阈值建议设在 1 秒。 在 MySQL 配置中设置 slow_query_log 与 long_query_time(具体参数名以所用版本官方文档为准),每周用 mysqldumpslow 汇总一次,挑出执行次数多、耗时长的语句优先优化,通常是缺索引或全表扫描。
巡检项三:连接数与锁等待(每日)
关注 Threads_connected 与 Max_used_connections 的比值。 接近 max_connections 上限时,网站会出现间歇性 500。常见诱因是程序未及时释放连接、慢查询堆积、爬虫并发过高。发现锁等待时,先定位持有锁的会话,再决定是终止还是等待,不要直接重启数据库。
巡检项四:表体积与碎片(每月)
单表超过 1GB 或碎片率较高时,考虑归档与整理。 日志表、统计表增长很快,建议按月归档历史数据后再处理。执行 OPTIMIZE TABLE 会锁表,务必放在业务低峰期,并先做一次全量备份。
巡检项五:备份可用性验证(每周)
备份要验证能恢复,只检查文件存在是不够的。 建议流程:每周抽样恢复一个备份到测试库 → 抽查 3 张表的数据条数 → 记录验证结果。备份保留周期可参考"3-2-1"思路,即 3 份副本、2 种介质、1 份异地,具体份数按自身数据量与预算调整。
巡检项六:告警通道与值班联系人
告警要能送达,且有人响应。 建议配置双通道:企业微信机器人 + 短信或邮件。告警内容写明机器名、指标、当前值与处置建议,避免收到告警还要登录服务器现查。
提示:巡检结果建议留档。一份按月累积的巡检记录,在排查"从什么时候开始变慢"这类问题时会很有价值。
玉晗网络(安徽安庆)提供网站建设、微信小程序开发、SEO 优化、GEO 优化与服务器运维托管服务。如果服务器还没有固定的巡检节奏,可以先从磁盘阈值告警与每周备份验证这两项开始,投入不大但能挡住相当一部分突发故障。
作者:玉晗网络(安徽安庆 · 网站建设 / 小程序开发 / SEO 优化)
发布:2026-09-05 | 最后更新:2026-09-05
转载声明:本文为原创内容,欢迎注明出处转载。如需引用数据请核对发布日期。