Files
group_fqcd_jr/tools/seed_knowledge_r1r5_faq.py
张胜宇 5d0becb67d 客服 Agent 重构收口:五出口决策链 + 知识库档位隔离 + 前端入参边界(答辩演示版本)
一、客服 Agent 智能增强(正面回应"不智能、动不动就转人工")
- 决策链由 2 个出口扩到 5 个:E1 澄清 / E2 计算型 / E3 知识直返 / E4 证据约束生成 / E5 分级回退
- 转人工从"默认动作"降为最后一档 E5c,只保留 4 类白名单:
  P0 反诈 / P1 账户与个人数据 / P2 写操作与争议 / 用户明确要求人工
- 46 条金标实测(修复前 → 修复后):
  转人工率 43.5% → 10.9%;出口准确率 45.7% → 100%;事实正确率 69.6% → 100%
  禁忌违反 1 → 0;档位越权 / 无出处数字 / 误拒 四项零容忍全 0
- 安全不变量 INV-1~INV-5;零容忍规则未删,改的是挂载点
  (输出侧字面黑名单 → 检索层档位隔离 + 判定层合规词表 + 输出守护)

二、知识库:档位单点化与物理隔离
- 新增 app/core/knowledge_tier.py 作为档位规则唯一落点(G-03),
  knowledge_contracts.py 原定义块改为显式再导出(X as X,非副本)
- 档位过滤由 bool 默认值(fail-open)改为 tiers 必填集合(缺参即 TypeError)
- Milvus 侧四集合按 visibility 分区键物理隔离;双 schema 收敛为一套
- 新增 app/core/actor.py:访客三元组与匿名判定的唯一构造/判定点(G-01/G-01b)
- 新增 app/core/fund_fee_rules.py:费率计算纯函数

三、前端入参边界对齐(本轮 W11 新修,4 处"校验宽于存储")
- message 加 max_length=8000(与浮窗 widget.js 的 maxlength 一致)
- session_id 加 1—64;idempotency_key 上限 128 → 64(对齐列宽 String(64))
- feedback_type 加 max_length=32(对齐列宽 String(32))
- 8 条路径参数补 min_length=1 + max_length=64 + 字符集正则
  ({session_id} / {run_id} / {handover_id})
- 改前超限值会落到 MySQL 才失败(500);改后一律 422 AGENT_INPUT_INVALID + 字段级定位
- 新增 tests/unit/api/test_frontend_boundaries.py(33 例),含"端点表 ↔ OpenAPI 全量对照"

四、投顾模块整体清除(D4.4 / D4.5)
- 删除投顾相关 controller / schema / model / repository / service 及门户页面
- tools/portal_api_check.py 同步作废 AD003/AD005/AD011/A047 四条用例与 advisor_t 登录
  (端点与账号均已不存在,此前稳定报 3 条假红)

五、验证(提交前实测)
- pytest -q:1856 passed / 2 skipped / 0 failed
- ruff check app tools tests:19(= 基线);mypy app:2(= 基线)
- 前端接口契约体检 portal_api_check.py:38 项,通过 34,失败 0,跳过 4
- 全链路冒烟 e2e_smoke_test.py --read-only:31/31
- HTTP 全链路探针 http_probe.py:11/11 succeeded
- 跨文档一致性 _consistency.py:GATE PASS
- 真机边界复验 12 条:12/12 符合预期

六、纪律与文档
- 可改文件白名单 A-09(docs/46)与底座会签申请单 A-10(docs/47,组 1—组 4 全部受理)
- 零 DDL:未新增/修改任何表结构,89 张业务表与基线一致
- 证据留痕:docs/evidence/**(含 46 条金标 score、快照、清除与重建记录)
- 未提交(刻意排除,见提交说明):仓库内 客服agent/ 与 开发文档/ 是 2026-09-16 前的
  过期副本(Todolist 440 行 vs 权威 D2.1 1167 行),权威正本在仓库外;
  _chunks_report.txt 是 tools/build_knowledge_chunks.py 生成的本地产物
2026-09-20 14:33:30 +08:00

165 lines
6.9 KiB
Python
Raw Permalink Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
"""补一条"r1到r5分别代表什么"的 FAQ 知识(幂等;解决该问法答不出来的问题)。
## 为什么需要它
用户实测:问「r1到r5分别代表什么」时客服不给答案(走兜底 + 转人工)。排查结论(2026-09-14):
- 向量库**有**内容,检索也命中(top1 = 那一套"高频问答对"里的 `R1到R5风险等级是什么意思?`,
相似度 **0.6621**);
- 但客服的判定是"中置信(0.55–0.75)必须**领先次优 ≥0.07**"(
`app/service/agent/implementations/customer_service.py:148-150`),而这一问的次优是
0.6412 → **只领先 0.021** → 判"候选并列",转人工。
根因是**同一主题有多个来源**:`高频问答对.txt` 的 R1–R5 条目、《个人投资者适当性管理指南》
第十一条(还切成好几块)、产品手册的 1.4 节——它们分数天然挤在一起,gap 永远拉不开。
## 这条为什么有效
实测(本机,qwen3-embedding):
| 条目形态 | 「r1到r5分别代表什么」的 top1 | 结论 |
|---|---|---|
| 长条目(表格 + 详细说明,488+433 字,切两块) | 0.6622 | 向量被长正文稀释,仍不过门槛 |
| 短条目(272 字,标题与问法近似) | 0.7214 | gap 0.059,仍差一点 |
| **短条目 + 标题与问法逐字对齐**(本条的做法) | **0.7384**,次优 0.6623 → **gap 0.0761 ≥ 0.07** | ✅ **可答** |
也就是:**命中条目的标题/正文与客户问法越贴近、块越短,相似度越高**;高置信档(≥0.75)
不要求 gap,中置信档靠"领先次优"过关。内容侧这一条就能修好,不必改门槛策略。
## 用法
```bash
# 先看要做什么(默认只读探测)
python tools/seed_knowledge_r1r5_faq.py
# 真正上传(需要 API 在跑,且 Worker 在跑以便投向量)
python tools/seed_knowledge_r1r5_faq.py --apply
```
幂等:若已存在同 `source_file` 的**未过期**知识,直接跳过(要覆盖先加 `--force`,
它会先删旧的再传新的)。
"""
from __future__ import annotations
import argparse
import asyncio
import base64
import sys
import time
import uuid
from pathlib import Path
import httpx
if hasattr(sys.stdout, "reconfigure"):
sys.stdout.reconfigure(errors="replace")
BASE_DEFAULT = "http://127.0.0.1:8000"
#: 知识正文放 `docs/`(与 `tools/seed_knowledge_demo.py` 读 `docs/43-…` 同一约定):
#: `data/` 被 `.gitignore` 忽略,放那里换环境就取不到了。
PROJECT_ROOT = Path(__file__).resolve().parents[1]
SOURCE = PROJECT_ROOT / "docs" / "45-风险等级R1到R5问答(知识库入库版).md"
FILENAME = "r1到r5分别代表什么.md"
PROBE_QUERY = "r1到r5分别代表什么"
def _login(client: httpx.Client, base: str, username: str, password: str) -> str:
response = client.post(
f"{base}/api/v1/auth/tokens", json={"username": username, "password": password}
)
if response.status_code != 200:
raise SystemExit(f"登录失败:HTTP {response.status_code} {response.text[:160]}")
return str(response.json()["data"]["access_token"])
def _headers(token: str) -> dict[str, str]:
return {"Authorization": f"Bearer {token}", "Idempotency-Key": uuid.uuid4().hex}
def _existing_active(client: httpx.Client, base: str, token: str) -> list[dict[str, object]]:
"""列未过期知识,挑出同 source_file 的条目(用于幂等)。"""
response = client.get(f"{base}/api/v1/knowledge/list", headers=_headers(token))
body = response.json()
items = body.get("items")
if items is None:
data = body.get("data")
items = data.get("items") if isinstance(data, dict) else data
if not isinstance(items, list):
return []
return [row for row in items if isinstance(row, dict) and row.get("source_file") == FILENAME]
def _probe_scores() -> None:
"""上传后核对检索评分(与客服判定同一口径)。"""
from app.service.agent.bootstrap import get_knowledge_search_service
from app.core.knowledge_contracts import ALL_TIERS
service = get_knowledge_search_service()
# 校验脚本按**全集档位**查:它要证明的是"这条知识进库了、能被检索到",
# 不是"访客能看到",故不受档位隔离限制。
outcome = asyncio.run(service.search(PROBE_QUERY, top_k=5, tiers=ALL_TIERS))
if not outcome.hits:
print(f" ⚠️ 「{PROBE_QUERY}」仍然没有命中")
return
top = outcome.hits[0].score
second = outcome.hits[1].score if len(outcome.hits) > 1 else 0.0
gap = top - second
verdict = "高置信直接答" if top >= 0.75 else (
f"中置信 gap={gap:.4f} → " + ("可答" if gap >= 0.07 else "仍会转人工")
)
print(f" 检索:top1={top:.4f}({outcome.hits[0].title[:30]}) 次优={second:.4f} → {verdict}")
def main() -> int:
parser = argparse.ArgumentParser(description="补 R1–R5 的 FAQ 知识(幂等)")
parser.add_argument("--base", default=BASE_DEFAULT, help="平台地址")
parser.add_argument("--username", default="admin_t")
parser.add_argument("--password", default="88888888")
parser.add_argument("--apply", action="store_true", help="真正上传(默认只看要做什么)")
parser.add_argument("--force", action="store_true", help="已存在时删旧的再传")
args = parser.parse_args()
if not SOURCE.exists():
raise SystemExit(f"知识正文不存在:{SOURCE}")
content = SOURCE.read_text(encoding="utf-8")
print(f"知识正文:{SOURCE}({len(content)} 字)")
with httpx.Client(base_url=args.base, timeout=120) as client:
token = _login(client, args.base, args.username, args.password)
existing = _existing_active(client, args.base, token)
print(f"库内同源未过期知识:{len(existing)} 条 {[r.get('knowledge_id') for r in existing]}")
if existing and not args.force:
print("已存在 → 跳过(要覆盖加 --force)。")
_probe_scores()
return 0
if not args.apply:
print("\n[dry-run] 未上传。加 --apply 真写。")
return 0
for row in existing:
kid = row.get("knowledge_id")
resp = client.delete(f"{args.base}/api/v1/knowledge/{kid}", headers=_headers(token))
print(f" 删除旧条目 {kid}: HTTP {resp.status_code}")
resp = client.post(
f"{args.base}/api/v1/knowledge/upload",
headers=_headers(token),
json={
"filename": FILENAME,
"content_base64": base64.b64encode(content.encode("utf-8")).decode("ascii"),
"knowledge_type": "faq",
},
)
print(f"上传:HTTP {resp.status_code} {resp.text[:200]}")
if resp.status_code != 201:
return 1
print("等 Worker 投向量 …")
time.sleep(12)
_probe_scores()
return 0
if __name__ == "__main__":
raise SystemExit(main())