fix(platform): 让"工具用不了"的三种原因可区分,并消掉选端点的隐式顺序依赖
基座层面的两处缺陷,都属于"静默失败"——排查成本高,且本项目已经各踩过一次。
1. tool_executor.py 的拒绝原因原先无法区分:
- "意图压根没发布白名单"与"白名单里没这个工具"共用一句「工具不在当前意图白名单」,
运维不知道该去补发布配置、还是改白名单内容(客服与风控的意图码都要求三处对齐,
两次都因此多花排查时间);
- 权限与角色两处只说「缺少工具权限」,不说是哪一个。
现在四种情况各有独立 message,各自指向不同的处置动作。
同时把**审计与异常分离**:白名单内容、权限码、角色集属于内部配置,只写进审计;
异常 message 会随 API 响应返回给调用方,保持通用、不泄漏配置。
2. model_gateway.py 的 TASK_CAPABILITY 补齐风控的几处 task_type
(risk_agent_chat / risk_analysis / risk_script / risk_summary / daily_report_suggestion)。
它们要的都是文本生成端点;不登记就会落到"未映射 → 返回全部 active 端点"的分支,
而能否选对端点取决于 model_endpoint_config 的**行顺序**——实测风控能跑通,仅仅因为
deepseek-flash(id=3) 恰好排在 qwen-embedding(id=5) 前面。这个隐式依赖现在消掉了。
未登记的 task_type 仍退回全部端点(保持原有保守策略:让故障表现为调用失败而不是
解析为空),但会记 warning,不再静默。
新增 tests/unit/service/test_tool_executor_denials.py(4 条),锁住"四种拒绝可区分"
与"内部细节只进审计、不进 message"。
ruff / mypy(135 文件) / 607 unit+contract 全绿。
This commit is contained in:
@@ -1,3 +1,4 @@
|
||||
import logging
|
||||
import os
|
||||
from collections.abc import Mapping
|
||||
from dataclasses import dataclass
|
||||
@@ -167,11 +168,22 @@ class DatabaseModelGateway:
|
||||
# 任何端点的能力名(deepseek 声明的是 text_generation/json_output/intent_classification),
|
||||
# 它需要的是「能生成结构化文本」的端点。若按同名筛选会得到空集,把记忆抽取打成
|
||||
# 失败关闭——这是修复端点筛选时最容易引入的回归。
|
||||
logger = logging.getLogger(__name__)
|
||||
|
||||
TASK_CAPABILITY: dict[str, str] = {
|
||||
"embedding": "embedding",
|
||||
"intent_classification": "intent_classification",
|
||||
"memory_extraction": "text_generation",
|
||||
"text_generation": "text_generation",
|
||||
# 风控的几处 task_type:它们要的都是"能生成文本"的端点,与 memory_extraction 同理。
|
||||
# 不登记就会落到下面"未映射 → 返回全部端点"的分支,而能否选到文本端点就取决于
|
||||
# `model_endpoint_config` 的**行顺序**——实测风控能跑通,仅仅因为 deepseek-flash(id=3)
|
||||
# 恰好排在 qwen-embedding(id=5) 前面。这种"靠数据顺序才对"的隐式依赖必须消掉。
|
||||
"risk_agent_chat": "text_generation",
|
||||
"risk_analysis": "text_generation",
|
||||
"risk_script": "text_generation",
|
||||
"risk_summary": "text_generation",
|
||||
"daily_report_suggestion": "text_generation",
|
||||
}
|
||||
|
||||
|
||||
@@ -195,6 +207,14 @@ class DatabaseModelEndpointResolver:
|
||||
)))
|
||||
capability = TASK_CAPABILITY.get(task_type)
|
||||
if capability is None:
|
||||
# 未登记的 task_type 仍退回全部端点(保持原有保守策略:让故障表现为调用失败、
|
||||
# 而不是解析为空),但必须留下痕迹。静默退回会让"选端点靠表行顺序"这类问题
|
||||
# 在下游以"偶发调用失败"的形式冒出来,极难定位。
|
||||
logger.warning(
|
||||
"模型端点筛选:task_type=%r 未登记能力映射,退回全部 active 端点;"
|
||||
"请在 TASK_CAPABILITY 中补上它对应的能力",
|
||||
task_type,
|
||||
)
|
||||
return endpoints
|
||||
matched = [
|
||||
endpoint for endpoint in endpoints
|
||||
|
||||
Reference in New Issue
Block a user