Files
group_fqcd_jr/tools/audit_schema.py
T
lzf_0626 6516ccb385 feat: 第二版——接口契约对齐 docs/05,修复静默故障与数据库基线
相对第一版 46fc976 的完整变更。组员迁移对照表见 docs/20。

一、对外契约对齐 docs/05(破坏性,共 4 处,组员需按 docs/20 调整)
1) 配置发布端点改为文档规定的复数资源名:submit→validations、
   approve→reviews(需 body decision)、activate→activations、
   rollback→rollbacks;第一版这 4 个动词式路径 docs/05 从未定义过。
2) 错误码由 8 个笼统码改为 15 个具体语义码(FORBIDDEN→AGENT_PERMISSION_DENIED、
   UNAUTHORIZED→AUTHENTICATION_REQUIRED、CONFLICT→RESOURCE_VERSION_CONFLICT、
   RESOURCE_NOT_FOUND→RUN_NOT_FOUND/SESSION_NOT_FOUND 等),
   输入类错误状态码 400→422。
3) POST /api/v1/agent-runs 与 GET /api/v1/agent-runs/{run_id} 统一为
   {data, meta} 信封(data 内字段名与语义未变)。
4) 错误响应体统一为 {error:{code,message,retryable,field_errors}, meta:{trace_id}},
   不再返回 FastAPI 默认的 {"detail": ...}。

二、数据库基线与约束
新增 39 张表的基线迁移(链根)与联合唯一键纠偏(4 张表、删 8 增 4,幂等收敛);
撤下 config_release 的双人复核 CHECK(应用层已允许自审,审核节点保留,
自审如实写入 reviewer_id);记忆 active key 生成列与唯一键;
activate 开始记录 supersedes_release_id 使版本链可追溯。
docs/00 基线未修改,未重命名或删除任何表与字段。

三、修复会静默出错或无报错的缺陷
- 跑完集成测试后平台会静默失去生效配置:清理只删自己创建的版本,却没有恢复被它
  顶成 superseded 的原生效版本,且审计一并删除因而完全无痕,表现为所有工具被拒
  但没有任何报错。已修清理逻辑并加恢复。
- Worker 单轮异常导致进程退出;记忆抽取调用方的“事务已开始”异常;
  召回缓存丢失 degraded 标记;连接时区未生效导致 created_at/updated_at 差 8 小时;
  .env 与 os.getenv 密钥来源分裂导致“没有可用的已批准模型端点”。
- 记忆信号识别漏判与跨键误命中;SSE 未带 Accept 的协商行为。

四、功能补齐
记忆链路 P1/P2/P3(抽取、受控词表、召回与缓存、生命周期级联及投影事件)、
fin_* 场内交易只读 ORM 层、agent_intent_config 状态流转并在运行期真正生效、
限流(Redis 固定窗口、故障一律放行)、游标校验、trace_id 中间件、
示例业务 Agent fund_query_demo 与一键端到端验证脚本,以及审计/指纹/迁移状态工具。

五、文档与验证
新增 docs/19(业务 Agent 接入实操)、docs/20(第一版迁移指南)与 docs/evidence 证据;
docs/01/02/06/08/09/17 同步实现现状。

验证结果:ruff 通过、mypy 103 文件无错、unit+contract 447 passed、
integration 29 passed、acceptance_check --production 7 PASS、
demo_agent_e2e 9/9 PASS(含失败关闭反证)。
2026-09-10 15:55:54 +08:00

89 lines
2.8 KiB
Python

"""表存在性审计:`baseline_generated.sql` 声明的表 vs MySQL 实际表。
与另两个工具互补:
- `tools/audit_constraints.py`:唯一键 ↔ 文档基线、ORM 映射 ↔ 库列名;
- `tools/schema_fingerprint.py`:字段、索引与外键的结构指纹;
- 本脚本:表名集合与列存在性。
凭据来自 `.env` 的 `MYSQL_DSN`,不在脚本内硬编码口令。
"""
from __future__ import annotations
import re
import sys
from pathlib import Path
from sqlalchemy import create_engine, text
ROOT = Path(__file__).resolve().parents[1]
sys.path.insert(0, str(ROOT))
from app.core.config import get_settings # noqa: E402
SQL_FILE = ROOT / "alembic" / "baseline_generated.sql"
# baseline_generated.sql 只覆盖基线表;以下平台增量表由 Alembic 迁移创建。
INCREMENTAL_TABLES = {
"agent_run",
"domain_event_outbox",
"request_idempotency",
"config_release",
"platform_config_item",
"model_endpoint_config",
"model_routing_rule",
"model_routing_fallback",
"prompt_template_version",
"outbox_delivery",
"svc_conversation_session",
"api_request_receipt",
}
def expected_tables() -> set[str]:
content = SQL_FILE.read_text(encoding="utf-8")
return set(re.findall(r"CREATE TABLE `?([A-Za-z0-9_]+)`?", content))
def main() -> int:
engine = create_engine(get_settings().mysql_dsn.replace("mysql+asyncmy", "mysql+pymysql"))
with engine.connect() as connection:
actual = set(
connection.execute(
text(
"SELECT TABLE_NAME FROM information_schema.TABLES "
"WHERE TABLE_SCHEMA = DATABASE()"
)
)
.scalars()
.all()
) - {"alembic_version"}
expected = expected_tables() | INCREMENTAL_TABLES
missing = expected - actual
unexpected = actual - expected
if missing or unexpected:
print(f"schema audit FAILED: missing={sorted(missing)} unexpected={sorted(unexpected)}")
return 1
rows = connection.execute(
text(
"SELECT TABLE_NAME, COLUMN_NAME FROM information_schema.COLUMNS "
"WHERE TABLE_SCHEMA = DATABASE()"
)
).all()
engine.dispose()
column_counts: dict[str, int] = {}
for table, _column in rows:
column_counts[table] = column_counts.get(table, 0) + 1
without_columns = sorted(table for table in expected if not column_counts.get(table))
if without_columns:
print(f"schema audit FAILED: tables without columns: {without_columns}")
return 1
print(f"schema audit passed: {len(expected)} business tables, no missing or unexpected tables")
return 0
if __name__ == "__main__":
raise SystemExit(main())