安全模型
安全模型检测风险;路由决策和插件决定采取什么行动。仅启用模型不会自动阻止请求或执行脱敏。
| 检查 | 检测内容 | 配置处理方式 |
|---|---|---|
| 提示词防护 | 提示词注入和越狱 | 越狱信号 |
| PII | 文本中的个人信息 | PII 信号 |
| 幻觉 | 回答中缺乏所提供上下文支持的说法 | 幻觉检测插件 |
| 事实核查 | 请求是否需要事实验证 | 事实核查信号 |
提示词防护
将以下片段合入配置,即可启用维护的本地防护模型:
global:
model_catalog:
modules:
prompt_guard:
enabled: true
variant: mmbert32k
threshold: 0.7
on_error: block
然后添加越狱信号及处理匹配结果的决策。如需使用独立部署的模型,参照外部服务。配方中的 prompt_guard binding 选择模型;阈值和路由策略仍在原有位置配置。
PII
使用完整的 token 分类模型及匹配的 PII 标签映射。在配方中通过 pii_classifier binding 选择模型,并设置 contract: token_spans.v1。按进程内模型设置 deployment 和 adapter,再提供模型的 mapping_path。PII 指南介绍实体阈值和脱敏配置。
外部 PII 服务必须返回带分数的实体和有效的 Unicode 文本位置。无效响应属于错误,不能视为成功且未发现实体的扫描。