feat(aihr): prepare grounded agent shadow validation
This commit is contained in:
@@ -24,6 +24,14 @@
|
||||
- 保留现有统一 Agent API、认证解析、知识授权、RAG 治理和审计。
|
||||
- 金额候选/送模/复核成为确定性校验器的第一条纵向切片。
|
||||
- 旧路径在影子验证期间继续承担兼容回退。
|
||||
- 新运行时先以默认 `OFF` 的异步 SHADOW 旁路挂在现役文本入口之后;旧响应先完成,旁路不得改变客户端契约,媒体/附件不进入影子执行。
|
||||
- SHADOW 使用有界队列、独立 watchdog 和单次原子终态;审计只保存 query hash、授权范围哈希、结构化代码、计数与耗时,不保存问题、答案、附件或工具正文。
|
||||
- 工具必须声明 schema、授权、时效、幂等、审计和允许意图。
|
||||
- `PARTIAL` 只能输出已覆盖 claim slots;零合格证据不调用答案模型。
|
||||
- 客户端最终按 `DecisionStatus` 展示完整、部分、需补充、无依据和冲突状态。
|
||||
|
||||
## 本地验证更新(2026-08-04)
|
||||
|
||||
- 治理 Qdrant `aihr_knowledge_governed_v1` 已在本地以 MySQL 有效 production fragments 幂等重建:224/224 points 一致,1024 维 Cosine,`BAAI/bge-m3`,payload 治理字段完整。
|
||||
- 真实 HTTP 仍只启用进程级 `SHADOW` 诊断,旧响应保持用户可见;金额变体、能力查询、CRM 能力边界、待办+流程和第二项材料已通过双工具/能力工具观测。正式来源缺失时为 `NO_EVIDENCE` 或 `PARTIAL`,不调用答案生成模型。
|
||||
- 最近样本 Planner 约 1.4-4.1 秒、shadow 总耗时约 3.1-7.3 秒,默认 4 秒仅是旁路保护预算,不是生产 SLA。尚未具备客户端灰度接管条件,也没有在缺少 100-300 条人工黄金集时宣称召回率达标。
|
||||
|
||||
Reference in New Issue
Block a user