v0.2.8:有界召回质量
v0.2.8 新增确定性、插件式的召回质量层,在较弱证据进入 Agent 上下文之前对其进行限制。
新增
- 召回新增
strict-v1、balanced-v1和exhaustive-v1策略,并提供自定义确定性策略注册表。 - Provider 会显式声明 score 是否为归一化相关度。未知或未声明的 score 量纲只作为补充证据,不会被不安全地套用绝对阈值。
- 召回来源返回结构化质量统计,包括候选数、保留数、选中数、丢弃数、无 score 数和未知量纲数。
- 质量过滤前会在有界范围内扩展候选,使严格策略能从更大的候选池中选择更强证据。
默认行为
- 默认使用
strict-v1。score 小于等于零,以及归一化 score 低于0.25的结果,会在序列化给 Agent 之前被丢弃。 - 高置信度结果(
score >= 0.6)在请求上限内全部可选;中等置信度结果最多四条,无 score 或未知量纲结果最多两条。 - 即使请求额度尚未用满,召回也不会再使用较弱证据强行补满。
- 可通过
recallQuality配置阈值、候选扩展倍数、中等结果预算、未知结果预算和策略。
兼容性与调优
- 持久化记忆数据和记忆空间布局不变,无需迁移。
- 本版本会有意改变默认召回选择。需要更宽松的低分补充时可使用
balanced-v1;需要保留原有 top-N 行为时可使用exhaustive-v1。 - 自定义策略会校验候选上限、结果资格、重复项和返回上限;不安全的自定义行为会回退到
strict-v1。
验证
- 完整测试套件 343 项通过;Windows 专用 smoke test 只会在非 Windows 本地环境跳过;Ubuntu 和 Windows CI 均通过。
- 在隔离的 28 条记忆基准中,可回答问题的上下文减少 48.3%,无答案问题的上下文减少 60.4%。
- 实测取舍为 Recall@10 从 100% 降至 85.4%,nDCG@10 从 0.948 变为 0.923。优先追求最大覆盖率的部署应选择或回退到更宽松的策略。
升级
更新 dsh-mnemon 后重启对应 DSH profile。若部署优先追求最大召回而不是有界上下文,请检查 recallQuality 配置。
上一个补丁版本见 v0.2.7 发布说明。