创建时间: 2026-03-24最后更新: 2026-08-21作者: yangbo(af030e08e)
1、风险
前文介绍过一个设计原则:AI 管线中的节点应该保持独立,并且能够被替换。例如记忆检索可以从纯向量检索升级为混合检索,情绪分类可以从规则引擎升级为 LLM 分类,Prompt 模板可以从 v2 升级为 v3
不过,工程上能够替换,并不代表上线过程足够安全。新节点可能确实改善了效果,也可能只是改变了问题的表现方式,因此不能直接通过全量发布来验证。单元测试很难覆盖这类变化,主要有三个原因:
- 用户输入空间太大,测不完
- LLM 输出具有非确定性,不能只用
assertEqual判断质量 - 很多质量变化是渐进的,不会立刻报错,例如记忆召回率缓慢提升、情绪系统逐渐稳定
因此,节点替换需要一条逐步验证的发布路径,而不是直接切换全部流量。
正在验证登录状态
请稍候,验证完成后将继续显示文章内容