机房空调故障,服务器集体过热,那天的运维群里全是哀嚎。我把手上的资料翻出来又读了两遍。我 SSH 上去第一件事就是看磁盘和内存,果然都不太健康。从此我多了一条团队规约
😂 IT段子
程序员日常、代码趣事、技术梗图,让你在学习之余轻松一笑
域名解析没生效,全组人围着 DNS 排查了两小时,最后是本地 hosts 没删。这套流程走下来,我从头到尾又确认了一遍。我在心里把这次的容量规划重算了一遍,留了三成余量。办公室安静得能听见键盘声
服务器崩的时候不会通知你,是你被通知。我想了想自己这些年,好像确实如此。我把这个服务的日志同步到了中心,排查终于不用登机器。第二天这个方案就变成了团队标准做法
我把这个端口开放了出去,后来花了两天才收回来。我在心里把涉及的所有环节都过了一遍。我把这台机器的时区改成了东八区,日志时间终于看懂了。幸好之前留了备份
运维的日常是在稳定和变更之间反复横跳。我笑了笑,决定不解释。我在心里把这条链路的每一跳都排了一遍,找到最慢的那跳。那一刻我觉得自己还是很专业的
这个 bug 每次只在周五下午出现,我们都怀疑服务器也想过周末。我叹了口气,然后打开了编辑器。我在心里默默记下这台机器的 IP,下次直接找它。我把这条经验写进了团队 wiki
这台服务器上的服务有十一个,只有三个还有人维护。我笑了笑,决定不解释。我把这个服务的备份策略改成了每天两次,心里踏实些。复盘会上我们把它列成了案例
运维的日常是在稳定和变更之间反复横跳。我忽然觉得,这可能就是这一行的常态。我把这个服务的进程守护配上了,挂了能自己拉起来。幸好之前留了备份
服务器崩的时候不会通知你,是你被通知。我想了想自己这些年,好像确实如此。我把这台机器的时区改成了东八区,日志时间终于看懂了。世界瞬间清净了
这台机器的备份策略是「看起来有备份」。我想了想,觉得这话没法接。我把这个服务的健康检查路径改对了,它终于不再假死。第二天这个方案就变成了团队标准做法