目录

v0.2.8:有界召回质量

在 GitHub 上查看源文件

v0.2.8 新增确定性、插件式的召回质量层,在较弱证据进入 Agent 上下文之前对其进行限制。

新增

  • 召回新增 strict-v1、balanced-v1 和 exhaustive-v1 策略,并提供自定义确定性策略注册表。
  • Provider 会显式声明 score 是否为归一化相关度。未知或未声明的 score 量纲只作为补充证据,不会被不安全地套用绝对阈值。
  • 召回来源返回结构化质量统计,包括候选数、保留数、选中数、丢弃数、无 score 数和未知量纲数。
  • 质量过滤前会在有界范围内扩展候选,使严格策略能从更大的候选池中选择更强证据。

默认行为

  • 默认使用 strict-v1。score 小于等于零,以及归一化 score 低于 0.25 的结果,会在序列化给 Agent 之前被丢弃。
  • 高置信度结果(score >= 0.6)在请求上限内全部可选;中等置信度结果最多四条,无 score 或未知量纲结果最多两条。
  • 即使请求额度尚未用满,召回也不会再使用较弱证据强行补满。
  • 可通过 recallQuality 配置阈值、候选扩展倍数、中等结果预算、未知结果预算和策略。

兼容性与调优

  • 持久化记忆数据和记忆空间布局不变,无需迁移。
  • 本版本会有意改变默认召回选择。需要更宽松的低分补充时可使用 balanced-v1;需要保留原有 top-N 行为时可使用 exhaustive-v1。
  • 自定义策略会校验候选上限、结果资格、重复项和返回上限;不安全的自定义行为会回退到 strict-v1。

验证

  • 完整测试套件 343 项通过;Windows 专用 smoke test 只会在非 Windows 本地环境跳过;Ubuntu 和 Windows CI 均通过。
  • 在隔离的 28 条记忆基准中,可回答问题的上下文减少 48.3%,无答案问题的上下文减少 60.4%。
  • 实测取舍为 Recall@10 从 100% 降至 85.4%,nDCG@10 从 0.948 变为 0.923。优先追求最大覆盖率的部署应选择或回退到更宽松的策略。

升级

更新 dsh-mnemon 后重启对应 DSH profile。若部署优先追求最大召回而不是有界上下文,请检查 recallQuality 配置。

上一个补丁版本见 v0.2.7 发布说明。