讲一个昨晚的事情。昨晚有一个数据跑失败了,原因是之前用的基础设施中,一个数据库满了。但是这个数据库满了之后,扩容有点麻烦,它是不能动态扩容的。所以昨天晚上,就硬着要去做了一个快照清除,跑得非常慢。
其实在此之前,我早就打算放弃这个数据库了,已经并行跑了一段时间自己私有云上的另一个数据库。昨天其实是可以直接把这个数据链路给替掉的。有可能让 AI 做起来,还比专门去跑那个快照任务花的时间要更短一些。
但是,我还是沿用了没有 AI 之前的工作习惯:遇到这种生产级的故障时,还是优先考虑怎么去做单点恢复。
其实有了 AI 之后,像我这种个人的东西,不是那种大公司的,就可以立马让 AI 上手去把那个东西给改掉,有可能是比原来的路径还要更快。这个对于我来说,也是一个蛮有冲击的例子。