四平搞技术的同行聊备份,动不动就说要上容灾。备份方案不按贵选,按数据类型选,本地的业务用不着那么重。我按类型给你拆。备份任务加个监控:每天备份完发一条成功消息到群里,没收到消息就是出事了。备份这东西,静悄悄失败最可怕,一条通知比十次检查都管用。定期看看错误日志:一周十分钟,挑红色的看。很多大毛病在日志里早就喊了半个月,只是没人理它。日志不会说谎,就看你看不看。
网站文件:周备全量够了
程序和图片基本不变,一周全量备份一次,改版当天加备一次。放云存储,一年几十块。恢复演练别走形式:真的拿备份在一个干净环境里把站跑起来,数据点开看,订单翻一翻。走完这套,你才能拍胸脯说备份是真备份。
数据库:这是命根子
订单、会员、账目都在库里,每天全量加binlog增量,保留至少三十天。库的备份单独放,别跟网站文件混在一起。恢复演练每半年做一次,备而不用验,等于没备。改任何东西之前先做一件事:把现在的样子截图存档。改好了有对比,改坏了能还原。这个习惯花不了十秒,救过我不止一回。
配置文件:最容易被忽略
nginx配置、crontab、环境变量,这些丢了重建最费时。每次改动就备份一次,放进版本管理更好。我见过服务器崩了重建,程序都在,配置谁也想不起来,折腾两天。技术活分两步走:先在测试的地方折腾明白,再搬到正经环境。多花的那点功夫,比线上出事再补救便宜太多。四平的站长听我一句,别图省那一步。
本地业务的低成本组合
网站文件周备加数据库日备加binlog增量,全放云端加一份本地,一年总成本两百块上下。四平周边十有八九的站,这套够用到规模翻倍。真正需要异地容灾、双活的,那是业务中断一小时损失几十万的盘子,按需再说。把常用操作记成小抄:怎么备份、怎么续证书、怎么看日志,一条条写下来存好。下次照着做就行,不用每次都现琢磨,也不求人。
总结
四平的技术同行选备份,文件周备、库日备加增量、配置随改随备,云端加本地双份,半年演练一次。按这个清单盘一遍你手上的系统,缺哪项这周就补哪项。