Files
group_fqcd_jr/docs/evidence/20260909-memory-signal-review.md
lzf_0626 6516ccb385 feat: 第二版——接口契约对齐 docs/05,修复静默故障与数据库基线
相对第一版 46fc976 的完整变更。组员迁移对照表见 docs/20。

一、对外契约对齐 docs/05(破坏性,共 4 处,组员需按 docs/20 调整)
1) 配置发布端点改为文档规定的复数资源名:submit→validations、
   approve→reviews(需 body decision)、activate→activations、
   rollback→rollbacks;第一版这 4 个动词式路径 docs/05 从未定义过。
2) 错误码由 8 个笼统码改为 15 个具体语义码(FORBIDDEN→AGENT_PERMISSION_DENIED、
   UNAUTHORIZED→AUTHENTICATION_REQUIRED、CONFLICT→RESOURCE_VERSION_CONFLICT、
   RESOURCE_NOT_FOUND→RUN_NOT_FOUND/SESSION_NOT_FOUND 等),
   输入类错误状态码 400→422。
3) POST /api/v1/agent-runs 与 GET /api/v1/agent-runs/{run_id} 统一为
   {data, meta} 信封(data 内字段名与语义未变)。
4) 错误响应体统一为 {error:{code,message,retryable,field_errors}, meta:{trace_id}},
   不再返回 FastAPI 默认的 {"detail": ...}。

二、数据库基线与约束
新增 39 张表的基线迁移(链根)与联合唯一键纠偏(4 张表、删 8 增 4,幂等收敛);
撤下 config_release 的双人复核 CHECK(应用层已允许自审,审核节点保留,
自审如实写入 reviewer_id);记忆 active key 生成列与唯一键;
activate 开始记录 supersedes_release_id 使版本链可追溯。
docs/00 基线未修改,未重命名或删除任何表与字段。

三、修复会静默出错或无报错的缺陷
- 跑完集成测试后平台会静默失去生效配置:清理只删自己创建的版本,却没有恢复被它
  顶成 superseded 的原生效版本,且审计一并删除因而完全无痕,表现为所有工具被拒
  但没有任何报错。已修清理逻辑并加恢复。
- Worker 单轮异常导致进程退出;记忆抽取调用方的“事务已开始”异常;
  召回缓存丢失 degraded 标记;连接时区未生效导致 created_at/updated_at 差 8 小时;
  .env 与 os.getenv 密钥来源分裂导致“没有可用的已批准模型端点”。
- 记忆信号识别漏判与跨键误命中;SSE 未带 Accept 的协商行为。

四、功能补齐
记忆链路 P1/P2/P3(抽取、受控词表、召回与缓存、生命周期级联及投影事件)、
fin_* 场内交易只读 ORM 层、agent_intent_config 状态流转并在运行期真正生效、
限流(Redis 固定窗口、故障一律放行)、游标校验、trace_id 中间件、
示例业务 Agent fund_query_demo 与一键端到端验证脚本,以及审计/指纹/迁移状态工具。

五、文档与验证
新增 docs/19(业务 Agent 接入实操)、docs/20(第一版迁移指南)与 docs/evidence 证据;
docs/01/02/06/08/09/17 同步实现现状。

验证结果:ruff 通过、mypy 103 文件无错、unit+contract 447 passed、
integration 29 passed、acceptance_check --production 7 PASS、
demo_agent_e2e 9/9 PASS(含失败关闭反证)。
2026-09-10 15:55:54 +08:00

4.2 KiB
Raw Permalink Blame History

记忆信号识别复核(2026-09-09)

对 P2 新增的 app/service/memory_taxonomy.py 做只读复核:直接调用 detect_memory_signals() 喂入 8 条真实语料,检查"该命中的命中、不该命中的不命中"。

python -c "from app.service.memory_taxonomy import detect_memory_signals; ..."

一、实测结果

输入 命中 判定
我的风险偏好是稳健型 preference:risk_level、preference:product_type 误命中:product_type 不该出现
我的风险偏好是稳健型,只买债券基金 同上两个键 同上(只买债券 才是 product_type 的真实信号)
我想买基金,帮我看看 无 正确(意图不等于偏好)
我打算三年内不赎回,流动性要好 constraint:liquidity、goal:target 漏命中 preference:horizon
我接受不了亏损,最多回撤5% 无 漏命中 constraint:loss_tolerance
今天大盘怎么样 无 正确
帮我查一下159915的净值 无 正确(不误触)
我已经结婚了,还有两个孩子要养 无 漏命中 profile:family

二、三个缺陷

  1. 模式重叠导致误命中。preference:product_type 的模式含宽泛的「偏好」,而 preference:risk_level 的模式含「风险偏好」,任何风险偏好陈述都会同时命中两者。 后果:模型可能据此抽出一条并不存在的"产品类型偏好"记忆。
  2. 模式过于字面导致大面积漏命中。当前模式多是完整短语("不能亏"、"最大回撤"、 "不接受亏损"、"已婚"、"有孩子"、"三年内不用"),真实用户表述("接受不了亏损"、 "最多回撤5%"、"结婚了"、"两个孩子"、"三年内不赎回")全部不匹配。 这直接削弱 P2 的核心目标:抽取质量。
  3. 正例表现正常——「我想买基金」「今天大盘怎么样」「查净值」均不误命中, 说明问题在覆盖度与重叠控制,而不是整体判据方向。

三、修复建议(P2 落地后执行)

  • preference:product_type:移除宽泛的「偏好」,改为 只买、只投、偏好股票、 偏好债券、偏好货币、倾向于买。
  • constraint:loss_tolerance:补 接受不了亏损、不能接受亏损、回撤、怕亏、 亏损承受。
  • profile:family:补 结婚、孩子、子女、配偶、赡养、家庭。
  • preference:horizon:补 不赎回、打算持有、计划持有、长期、短期。
  • 增加重叠约束:同一片段不应同时命中语义互斥的键(如 risk_level 与 product_type), 或者把模式匹配改为"最长匹配优先归属单一键"。
  • 上述每一条都要补成回归测试(正例 + 反例),而不是只改模式字符串。

四、状态:已修复并配回归测试

修复已落地在 app/service/memory_taxonomy.py:

  • preference:product_type 移除宽泛的「偏好」,改为「只买 / 只投 / 只做 / 倾向买 / 偏好股票 …」;
  • constraint:loss_tolerance 补「接受不了亏损 / 不能接受亏损 / 回撤 / 怕亏」;
  • profile:family 补「结婚 / 孩子 / 子女 / 配偶 / 赡养 / 家庭」;
  • preference:horizon 补「不赎回 / 打算持有 / 计划持有」;
  • goal:target 去掉裸「打算」(它在期限陈述里不构成目标收益目标)。

修复后实测:

['preference:risk_level']                          <- 我的风险偏好是稳健型
['constraint:loss_tolerance']                      <- 我接受不了亏损,最多回撤5%
['profile:family']                                 <- 我已经结婚了,还有两个孩子要养
['constraint:liquidity', 'preference:horizon']     <- 我打算三年内不赎回,流动性要好
[]                                                 <- 我想买基金,帮我看看

回归测试:tests/unit/service/test_memory_taxonomy_signals.py,11 个用例,每条用例同时断言 "必须命中"与"必须不命中",另含两条结构约束(信号键必须属于受控词表、键前缀必须是合法的 memory_type),避免今后只改模式字符串却没有回归保护。