上周改了系统提示里的一句话,三条业务线悄无声息地坏了,两天后才有人反馈。写点教训。 问题不在于那句话改错了,而在于我们把提示当文案在管,不是当代码在管。它没有版本,没有评审,改动没有 diff,出了事没人说得清是哪一次改的。而它对行为的影响,实际上比一半的代码都大。 现在的做法是:提示进仓库,跟代码一起走 PR;每条业务线固定一组回归用例,大概三十条,改提示必须先跑一遍,逐条对比输出的差异;差异不是自动判分,是人看的,因为大部分变化没有对错,只是风格漂移,得有人决定这个漂移能不能接受。 三十条用例听着少,但它拦下的两次都是那种上线之后极难查的问题。
