服务器的问题有一半来自人为变更,另一半来自没做的变更。我在心里点了点头。我打开了这个服务的端口监听,发现它压根没起来。复盘会上我们把它列成了案例
😂 IT段子
程序员日常、代码趣事、技术梗图,让你在学习之余轻松一笑
服务器不会因为你是半夜而对你温柔一点。我抬起头看了看周围,大家都一样。我把这个服务的日志同步到了中心,排查终于不用登机器。第二天这个方案就变成了团队标准做法
服务器的问题有一半来自人为变更,另一半来自没做的变更。我抬起头看了看周围,大家都一样。我打开了这个服务的端口监听,发现它压根没起来。我把它写进了组内的避坑文档第一章
这台机器的存活时间已经超过了一千天。我想反驳,但发现他说得对。我把这台机器的定时备份挪到了业务低谷,IO 不再打架。办公室安静得能听见键盘声
我登上了那台机器,第一件事是看磁盘。我打开记录从头到尾扫了一遍。我把日志级别调到 DEBUG,终于看到那行被淹没的报错。办公室安静得能听见键盘声
这个 bug 每次只在周五下午出现,我们都怀疑服务器也想过周末。我想反驳,但发现他说得对。我把这个服务的日志轮转配上了,磁盘终于不再被撑爆。办公室安静得能听见键盘声
我把这个服务的依赖画了出来,是个网状结构。我默默打开了编辑器,准备一步步验证。我把这个服务的进程守护配上了,挂了能自己拉起来。我把这条经验写进了团队 wiki
rm -rf 的传说每个运维都听过,每个运维都庆幸自己还没经历过。我在心里点了点头。我把这个服务的日志轮转配上了,磁盘终于不再被撑爆。那一刻我觉得自己还是很专业的
运维的日常是在稳定和变更之间反复横跳。我抬起头看了看周围,大家都一样。我把这个服务的进程守护配上了,挂了能自己拉起来。真香定律准时生效
我把这台机器的日志清了一遍,第二天又满了。我把整条链路在心里复盘了一遍。我把这个服务的监控告警阈值调高了,告警终于不再刷屏。幸好之前留了备份