相对第一版 46fc976 的完整变更。组员迁移对照表见 docs/20。
一、对外契约对齐 docs/05(破坏性,共 4 处,组员需按 docs/20 调整)
1) 配置发布端点改为文档规定的复数资源名:submit→validations、
approve→reviews(需 body decision)、activate→activations、
rollback→rollbacks;第一版这 4 个动词式路径 docs/05 从未定义过。
2) 错误码由 8 个笼统码改为 15 个具体语义码(FORBIDDEN→AGENT_PERMISSION_DENIED、
UNAUTHORIZED→AUTHENTICATION_REQUIRED、CONFLICT→RESOURCE_VERSION_CONFLICT、
RESOURCE_NOT_FOUND→RUN_NOT_FOUND/SESSION_NOT_FOUND 等),
输入类错误状态码 400→422。
3) POST /api/v1/agent-runs 与 GET /api/v1/agent-runs/{run_id} 统一为
{data, meta} 信封(data 内字段名与语义未变)。
4) 错误响应体统一为 {error:{code,message,retryable,field_errors}, meta:{trace_id}},
不再返回 FastAPI 默认的 {"detail": ...}。
二、数据库基线与约束
新增 39 张表的基线迁移(链根)与联合唯一键纠偏(4 张表、删 8 增 4,幂等收敛);
撤下 config_release 的双人复核 CHECK(应用层已允许自审,审核节点保留,
自审如实写入 reviewer_id);记忆 active key 生成列与唯一键;
activate 开始记录 supersedes_release_id 使版本链可追溯。
docs/00 基线未修改,未重命名或删除任何表与字段。
三、修复会静默出错或无报错的缺陷
- 跑完集成测试后平台会静默失去生效配置:清理只删自己创建的版本,却没有恢复被它
顶成 superseded 的原生效版本,且审计一并删除因而完全无痕,表现为所有工具被拒
但没有任何报错。已修清理逻辑并加恢复。
- Worker 单轮异常导致进程退出;记忆抽取调用方的“事务已开始”异常;
召回缓存丢失 degraded 标记;连接时区未生效导致 created_at/updated_at 差 8 小时;
.env 与 os.getenv 密钥来源分裂导致“没有可用的已批准模型端点”。
- 记忆信号识别漏判与跨键误命中;SSE 未带 Accept 的协商行为。
四、功能补齐
记忆链路 P1/P2/P3(抽取、受控词表、召回与缓存、生命周期级联及投影事件)、
fin_* 场内交易只读 ORM 层、agent_intent_config 状态流转并在运行期真正生效、
限流(Redis 固定窗口、故障一律放行)、游标校验、trace_id 中间件、
示例业务 Agent fund_query_demo 与一键端到端验证脚本,以及审计/指纹/迁移状态工具。
五、文档与验证
新增 docs/19(业务 Agent 接入实操)、docs/20(第一版迁移指南)与 docs/evidence 证据;
docs/01/02/06/08/09/17 同步实现现状。
验证结果:ruff 通过、mypy 103 文件无错、unit+contract 447 passed、
integration 29 passed、acceptance_check --production 7 PASS、
demo_agent_e2e 9/9 PASS(含失败关闭反证)。
68 lines
3.1 KiB
Python
68 lines
3.1 KiB
Python
from functools import lru_cache
|
|
|
|
from dotenv import load_dotenv
|
|
from pydantic import Field
|
|
from pydantic_settings import BaseSettings, SettingsConfigDict
|
|
|
|
# 把 `.env` 显式注入进程环境变量。pydantic-settings 只把 `.env` 读进 Settings 对象,
|
|
# **不会**写 `os.environ`;而模型密钥解析(`EnvironmentSecretResolver` 要求 secret_ref
|
|
# 形如 `env:VAR`)读的正是 `os.getenv`。两者不打通就会出现"按文档在 .env 里配好密钥、
|
|
# 运行时却读不到",且症状伪装成"没有可用的模型端点",排查方向被带偏。
|
|
# `override=False`:真实进程环境变量优先,`.env` 只作补充(生产用容器注入时不会被覆盖)。
|
|
load_dotenv(override=False)
|
|
|
|
|
|
class Settings(BaseSettings):
|
|
app_env: str = "local"
|
|
app_name: str = "jr-agent-platform"
|
|
log_level: str = "INFO"
|
|
timezone: str = "Asia/Shanghai"
|
|
jwt_issuer: str
|
|
jwt_audience: str
|
|
jwt_algorithm: str = "RS256"
|
|
jwt_private_key_path: str = "config/jwt/jwt-private.pem"
|
|
jwt_public_key_path: str = "config/jwt/jwt-public.pem"
|
|
jwt_clock_skew_seconds: int = Field(default=30, ge=0)
|
|
mysql_dsn: str
|
|
mysql_pool_size: int = Field(default=5, ge=1)
|
|
mysql_max_overflow: int = Field(default=10, ge=0)
|
|
mysql_tx_isolation: str = "READ COMMITTED"
|
|
redis_url: str
|
|
redis_connect_timeout_seconds: float = Field(default=2, gt=0)
|
|
# 限流(文档 §3.5 的 429 / §3.6 的 RATE_LIMITED)。默认值刻意宽松:
|
|
# 每用户每接口每分钟 600 次(10 QPS)。取值依据是"本地验收与集成测试的量级"——
|
|
# 两个验收脚本与 tests/integration 里同一身份对同一接口最多几十次调用,
|
|
# 600 留了一个数量级余量,绝不可能误伤;同时 10 QPS 已足以拦住单个客户端
|
|
# 把底座打爆(正常业务交互远低于 1 QPS)。生产按真实容量收紧即可,无需改代码。
|
|
rate_limit_enabled: bool = True
|
|
rate_limit_window_seconds: int = Field(default=60, gt=0)
|
|
rate_limit_max_requests: int = Field(default=600, ge=1)
|
|
rate_limit_key_prefix: str = "jr:rate_limit"
|
|
message_broker_url: str = ""
|
|
message_broker_run_topic: str = "agent.run"
|
|
message_broker_outbox_topic: str = "agent.outbox"
|
|
message_broker_dlq_topic: str = "agent.dlq"
|
|
milvus_uri: str
|
|
milvus_token: str = ""
|
|
milvus_collection: str = "jr_memory"
|
|
neo4j_uri: str
|
|
neo4j_database: str = "neo4j"
|
|
neo4j_username: str = "neo4j"
|
|
neo4j_password: str = ""
|
|
model_router_config_ref: str = "local"
|
|
model_default_endpoint: str = ""
|
|
model_fallback_endpoint: str = ""
|
|
sse_heartbeat_seconds: int = Field(default=15, gt=0)
|
|
sse_chunk_characters: int = Field(default=256, ge=1, le=4096)
|
|
sse_max_connection_seconds: int = Field(default=300, gt=0)
|
|
worker_lease_seconds: int = Field(default=60, gt=0)
|
|
worker_retry_limit: int = Field(default=3, ge=0)
|
|
worker_poll_seconds: float = Field(default=1, gt=0)
|
|
|
|
model_config = SettingsConfigDict(env_file=".env", env_file_encoding="utf-8", extra="ignore")
|
|
|
|
|
|
@lru_cache(maxsize=1)
|
|
def get_settings() -> Settings:
|
|
return Settings() # type: ignore[call-arg]
|