docs(aihr): reconcile grounded agent production state

This commit is contained in:
key
2026-08-04 23:09:06 +08:00
parent d3d214efb3
commit 09b1085d9e
7 changed files with 34 additions and 17 deletions
+1 -1
View File
@@ -4,7 +4,7 @@
## Unreleased
- **2026-08-04,受约束 Grounded Agent 与财务 RAG 证据门禁完成本地影子实现,未部署**:保留现有 `/api/aihr/agent/**` 客户端响应与旧 Orchestrator,不切流;新增 `ResolvedContext/SemanticQueryPlan/ExecutionContext/ToolCall/ToolResult/DocumentEvidence/VerifiedFact/DecisionResult/GroundedAnswer` 契约,接入 `MY_CURRENT_TASKS + KNOWLEDGE_SEARCH` 双工具、服务端授权参数注入、有界两轮工具执行、候选调用去重、受控超时、证据槽位/来源权威/正文蕴含门禁、逐结论引用校验及结构化会话状态。财务金额改为“原文候选 + LLM 语义判定 + 确定性 span/数值/币种复核”,覆盖 `¥500`、`五百块`、`不到500`、单笔/月累计与口径冲突;知识检索新增不生成答案的授权证据入口,并将候选召回、rerank 和最终 evidence/display 截断分层。30 条纯内存黄金场景、RAG/资料治理/Agent 新链路 166 项及旧 Planner/Orchestrator/会话兼容 45 项均通过;additive MySQL 8 迁移在本地开发库连续执行两次通过。该证据不包含真实模型 + MySQL/Qdrant 的端到端召回评测、100–300 条人工黄金集、客户端状态 UI、生产部署或正式账号验收,不能据此宣称生产召回率达标。
- **2026-08-04,受约束 Grounded Agent 与财务 RAG 证据门禁完成实现并受控发布**:新增 `ResolvedContext/SemanticQueryPlan/ExecutionContext/ToolCall/ToolResult/DocumentEvidence/VerifiedFact/DecisionResult/GroundedAnswer` 契约,接入 `MY_CURRENT_TASKS + KNOWLEDGE_SEARCH` 双工具、服务端授权参数注入、有界工具执行、候选调用去重、受控超时、证据槽位/来源权威/正文蕴含门禁、逐结论引用校验及结构化会话状态。财务金额覆盖 `¥500`、`五百块`、`不到500`、单笔/月累计与口径冲突;知识检索为不生成答案的授权证据工具,并将候选召回、rerank 和最终 evidence/display 截断分层。生产后端以 JAR SHA-256 `74d0cd2acc60ebf52f20eb8bee643f59395ba7cff3583076d671e57406f824ac` 发布,`wygj-aihr.service` 为 `active`,schema `83/83`,公开根站、租户列表和移动首页 HTTP 200;生产 `ACTIVE` 仅覆盖文本 `KNOWLEDGE_QA`/`LIVE_MY_WORK`,其余请求和不合格计划回退旧链路。30 条纯内存黄金场景、RAG/资料治理/Agent 新链路 166 项、旧 Planner/Orchestrator/会话兼容 45 项及 additive MySQL 8 迁移回归通过。认证态用户逐例问答、客户端状态 UI 全量验收、真实模型 + MySQL/Qdrant 的完整召回评测和 100–300 条人工黄金集仍待完成,不能据此宣称生产召回率达标。
- **2026-08-02,功能复核清单首批增量已实现并完成本地验证,未部署**:当前工作树新增大喇叭 `ALL/TARGET_ONLY` 可见性、受控在线查看与动态水印、下载门禁和带原文依据的主题标签;问师傅未解决反馈确认转待审核问题;正式学习任务、审核题库随机组卷及考试关联;案例经验“候选→审核→发布→下线”;原生异常恢复回归和资料暂存盘容量健康门禁。管理端生产构建、移动端类型检查与 `216/216` 单测、后端 `838/838` 测试及迁移静态清单通过;`390×844` 已验证员工主要入口和登录门禁。Docker/MySQL 未运行,四个 `aihr_20260802_*` 迁移尚未执行,管理端认证业务、峰值压测、签名 APK、真机、生产发布和严格试点均未验收。
- **2026-07-31,8 月 1 日受控内部公测门禁收口为 Go**:最新后端 JAR SHA-256 `d5145194024ba3526a869e3270df6d71468931b96ba9aebb93121592e54012eb` 已上线,正式政策模式只允许当前有效、已批准、版本与原文件哈希完整且与问题领域相关的来源进入回答;没有相关制度时失败关闭,不再回退经验萃取或访谈材料。使用生产现有 APP 账号重跑 30 道策略题,11 题只引用已批准正式来源,分期缴费题返回 `NO_EVIDENCE`,其余冲突、无依据和越权题按边界返回,合计 `30/30`;证据不保存手机号、验证码、令牌、问题或答案正文。生产 5 个 `v1.1` 场景及独立审核链、五通道各 2 名有效处理人、本通道正例/跨通道拒绝/一次正式回复 `5/5`、五类负责人委托签认,以及 `0.1.17 (117)` 的 DCloud 测试签名受控分发例外均已回填。严格内容门禁和生产只读就绪门禁均通过;同时修复就绪脚本把含 `|` 的场景快照直接作为 SSH 参数导致远端误解析为管道的问题,改为 Base64 单参数传输。该 Go 仅适用于受控内部公测,不代表应用商店发布、企业正式签名或阶段一严格试点窗口通过。
- **2026-07-30,5 个真实访谈场景已落入生产停用草稿,正式内容门禁保持 No-Go**:从 `D:\20260730` 的 12 份访谈材料中选择 7 份代表性来源,以脱敏主题和 SHA-256 登记到 `aug1-life-advisor-candidate-v0.2`,形成管道漏水责任、物业费争议、维修延期、停车冲突、收费与整改并行五个真实业务场景。已登录生产管理端逐条保存并按编码回查,场景总数从 `100` 增至 `105`,当前启用数保持 `86`,五项均为 `草稿 / 草稿未提交 / 停用`;费用复核作为业务动作和审核职责保留,不把系统不支持的财务部门伪装成住宅训练岗位。候选文件仍为 `publishable=false`,30 道政策题仍无标准答案;严格门禁继续准确保持正式场景 `0/5`、问题证据 `0/30`,本项没有提交业务审核、启用或发布场景,也没有部署代码、重启服务或执行 schema 迁移。
+9 -3
View File
@@ -1,6 +1,8 @@
# Grounded Agent ACTIVE 激活运行手册
状态:代码已实现,生产尚未切换。
状态:代码已实现,生产已于 2026-08-04 受控切换为 `ACTIVE`。
当前生产范围:仅文本 `KNOWLEDGE_QA` 和 `LIVE_MY_WORK` 使用 Grounded Agent;不符合严格计划、授权或证据门禁的请求仍回退既有链路。媒体、资源、外网、写入和训练请求继续走旧链路。认证态用户问答尚未完成逐例验收,本次发布不代表召回率达标。
## 配置契约
@@ -30,10 +32,14 @@ Grounded Agent 只把通过授权和证据门禁的结果适配为现有 `AgentR
1. 工作树干净后运行只读 `scripts/release-backend.sh plan`。
2. 仅使用计划输出的完整 `DEPLOY_BACKEND:<hash>` 授权串执行发布,不手工覆盖 JAR。
3. 发布后先保持 `OFF` 做服务、JAR、schema 和认证请求预检。
4. 通过内部账号验证后,再由受控 systemd drop-in 设置 `AIHR_AGENT_GROUNDED_MODE=ACTIVE` 并重启服务。
3. 发布后先核对服务、JAR、schema 和公开接口预检;生产默认仍以仓库配置的 `OFF` 构建。
4. 通过内部账号和受控预检后,才可由 systemd 配置设置 `AIHR_AGENT_GROUNDED_MODE=ACTIVE` 并重启服务。
5. 任一异常将环境变量改回 `OFF`,按同一配置路径重启;不需要回滚数据库结构。
本次已执行的生产事实:后端 JAR SHA-256 为 `74d0cd2acc60ebf52f20eb8bee643f59395ba7cff3583076d671e57406f824ac`,`wygj-aihr.service` 为 `active`,schema 预检 `83/83`,公开根站、租户列表和移动首页均返回 HTTP 200。配置文件为 `/opt/wygj/config/wygj.env`,配置备份为 `/opt/wygj/backups/wygj.env.grounded-active-20260804225348`,JAR 回滚备份为 `/opt/wygj/backups/backend-20260804224941-e9ecc467524d`。
尚未完成:认证态用户逐例问答、客户端各状态 UI 的完整验收,以及 100–300 条人工标注黄金集评测。没有这些证据,不宣称生产召回率达标,也不把当前 ACTIVE 视为完整客户端灰度。
审计只能记录 query hash、run ID、结构化状态、工具/证据计数、差异和耗时,不得写入原问题、答案、手机号、token、附件或工具正文。
没有 100-300 条人工标注黄金集前,不宣称正式召回率达标。
+10 -5
View File
@@ -1,6 +1,8 @@
# 帮道受约束业务 Agent TechSpec
状态:`IMPLEMENTED_AND_LOCALLY_VERIFIED_SHADOW`。已在现役 `/api/aihr/agent/**` 文本请求完成旧响应后异步旁路执行;默认 `OFF`,不改变旧响应,未部署生产。
状态:`IMPLEMENTED_AND_PRODUCTION_ACTIVE_LIMITED_SCOPE`。Grounded Agent 已在现役 `/api/aihr/agent/**` 文本入口落地;仓库默认 `OFF`,生产于 2026-08-04 受控启用 `ACTIVE`,仅接管符合范围和门禁的 `KNOWLEDGE_QA`、`LIVE_MY_WORK`,其余请求及不合格计划回退旧链路。
当前生产 JAR SHA-256:`74d0cd2acc60ebf52f20eb8bee643f59395ba7cff3583076d671e57406f824ac`;服务和公开预检已通过。认证态用户逐例验收、客户端状态 UI 全量验收和人工黄金集召回评测仍为 `PENDING`,因此不宣称生产召回率达标。
## 目标
@@ -83,17 +85,20 @@ Java 契约以 `AihrAgentGroundingDto` 为准。HTTP DTO 在兼容期保持 addi
首批 30 条纯内存契约黄金集覆盖金额口径、`哪些` 路由、CRM 能力幻觉、零证据、待办与流程、多轮第二项、月份纠正、跨项目、过期 factRef、来源冲突、工具失败/超时、模型失败回退、重复调用停止和对抗性槽位误标。该集合验证内部契约,不代表本地 MySQL/Qdrant/真实模型效果;没有 100-300 条人工黄金集前不宣称正式召回率达标。
## HTTP Shadow 边界
## HTTP 运行边界
- `aihr.agent.grounded-mode` 只允许 `OFF/SHADOW`,仓库与生产默认 `OFF`。`SHADOW` 复用现役认证主体、应用和项目输入,但在异步线程中重新解析并校验项目、空间与应用授权。
- `aihr.agent.grounded-mode` 允许 `OFF/SHADOW/ACTIVE`,仓库默认 `OFF`。`SHADOW` 复用现役认证主体、应用和项目输入,但在异步线程中重新解析并校验项目、空间与应用授权;`ACTIVE` 只在文本请求符合严格计划、授权和证据门禁时接管用户可见结果。
- 旧 `AihrAgentOrchestrator` 先完整生成用户可见 `AgentResponse`;旁路的计划、工具、DecisionResult 或失败均不得改写 `answer/status/citations/data/contextVersion`。媒体和附件请求明确跳过。
- 在生产 `ACTIVE` 下,合格文本请求由 `AihrAgentActiveService` 适配为兼容 `AgentResponse`;不支持的意图、工具失败、授权失败或异常继续返回旧链路结果,不改变旧客户端 DTO。
- 专用有界队列满时立即 `REJECTED`,watchdog 超时后取消任务;原子终态保证超时与迟到完成只记录一次。旁路失败不得阻断主请求。
- `aihr_agent_shadow_run` 只保存 run ID、query SHA-256、授权范围哈希、结构化 intent/tool/status/reason、数量和耗时,不保存原始问题、答案、手机号、token、附件名、Citation/Fact 正文或工具响应正文。
- 默认 `grounded-shadow-timeout-ms=4000` 是保守的旁路保护预算,不是模型服务 SLA。2026-08-04 的本地真实模型诊断仅通过进程环境临时放宽到 45000ms;样本显示规划耗时可超过 4 秒,因此在完成人工黄金集、延迟分位数和容量评估前不得开启生产 SHADOW,更不得切换客户端答案。
- 默认 `grounded-shadow-timeout-ms=4000` 是保守的旁路保护预算,不是模型服务 SLA。2026-08-04 的本地真实模型诊断仅通过进程环境临时放宽到 45000ms;样本显示规划耗时可超过 4 秒,因此不能把 4 秒预算当作模型 SLA,也不能据此扩大生产 ACTIVE 范围。生产当前仅保留受控文本范围,仓库默认仍为 `OFF`。
## 2026-08-04 本地实依赖验证
本次只在本地以 `SHADOW + 45000ms` 诊断运行,仓库默认值仍为 `OFF + 4000ms`,用户可见响应继续由旧 Orchestrator 生成。最近一组真实请求的 Semantic Planner 耗时约 `1.4-4.1s`、单次 shadow 总耗时约 `3.1-7.3s`;早期模型冷启动曾出现 `18.4s` 离群值。Qdrant 直接探测约 `0.2s`,当前主要延迟来自受约束模型规划、证据分类和旧知识查询审计,不应仅靠放宽 watchdog 掩盖。默认 4 秒预算仍不足以作为生产 SHADOW SLA,需先取得真实分位数和容量数据。
本地诊断曾以 `SHADOW + 45000ms` 运行,仓库默认值仍为 `OFF + 4000ms`。最近一组真实请求的 Semantic Planner 耗时约 `1.4-4.1s`、单次 shadow 总耗时约 `3.1-7.3s`;早期模型冷启动曾出现 `18.4s` 离群值。Qdrant 直接探测约 `0.2s`,当前主要延迟来自受约束模型规划、证据分类和旧知识查询审计,不应仅靠放宽 watchdog 掩盖。默认 4 秒预算不是模型服务 SLA,后续灰度仍需真实分位数和容量数据。
2026-08-04 生产发布后完成了 JAR、服务、schema 和公开接口核验;未完成认证态用户逐例问答验证。生产 `ACTIVE` 是有限范围的受控运行状态,不等于所有入口都已迁移,也不替代 100–300 条人工标注黄金集。
治理索引已完成本地幂等重建并通过当前事实核对:MySQL 有效 `production`、`PUBLISHED`、`HUMAN_VERIFIED` fragment 为 `224`,`aihr_knowledge_governed_v1` 为 `green`、`224` points、`1024` 维 Cosine,模型为 `BAAI/bge-m3`;224 个 points 与 MySQL fragment 一一对应,payload 必填治理字段缺失为 0,全部属于 `production/PUBLISHED/HUMAN_VERIFIED`。这只证明索引和治理过滤可用,不证明检索召回率达标。
+1 -1
View File
@@ -2,7 +2,7 @@
本文维护当前前后端业务接口和安全边界;旧演示流继续保留降级链,但不能作为生产或试点通过证据。
> 2026-08-04 本地 Grounded Agent 已在 `/api/aihr/agent/**` 文本请求的旧响应完成后增加异步 SHADOW 旁路,但仓库与生产默认 `OFF`,旁路结果不进入客户端响应,媒体/附件请求跳过。其内部 DTO、双工具、证据门禁、结构化会话状态和隐私审计见 [AIHR_GROUNDED_AGENT_TECHSPEC.md](AIHR_GROUNDED_AGENT_TECHSPEC.md);尚未部署生产,生产行为仍以本页现役接口说明为准。
> 2026-08-04 Grounded Agent 已接入 `/api/aihr/agent/**` 文本入口;生产仅对通过严格计划、授权和证据门禁的 `KNOWLEDGE_QA`、`LIVE_MY_WORK` 使用 `ACTIVE`,其余请求继续走兼容旧链路。仓库默认 `OFF`,媒体/附件请求跳过。其内部 DTO、双工具、证据门禁、结构化会话状态和隐私审计见 [AIHR_GROUNDED_AGENT_TECHSPEC.md](AIHR_GROUNDED_AGENT_TECHSPEC.md);认证态用户逐例验收、客户端状态 UI 全量验收和人工黄金集评测仍待完成。
## 第一阶段范围
+2 -2
View File
@@ -11,7 +11,7 @@
3. 专项 TechSpec 细化单个领域;实施计划可记录本地实现与验证,但部署和生产状态仍以审查文档、接口事实和真实环境证据为准。
4. `prototypes/` 只作视觉回归基准;会议纪要、历史 Prompt、`legacy/` 与 `archive/` 只作需求来源和追溯材料。
“问”模块的产品边界见[《数字师傅工作 Agent 总体设计》](superpowers/specs/2026-07-24-digital-master-agent-design.md),现役旧链路的实施与验证进度见[《实施计划》](superpowers/plans/2026-07-24-digital-master-agent.md);2026-08-04 本地 Grounded Agent 已以默认关闭的异步 SHADOW 旁路挂到现役文本入口,但尚未切换用户可见响应,其架构与运行边界以[专项 TechSpec](AIHR_GROUNDED_AGENT_TECHSPEC.md)和[ADR-002](adr/ADR-002-GROUNDED-AGENT-EXECUTION.md)为准。工作助手相关术语、实施状态与文档关系集中在[《工作助手与今日工作成果迭代计划》](工作助手与今日工作成果迭代计划-20260721.md)。阶段一“练”的唯一后续施工范围见[《AI陪练完整交付计划》](AI陪练完整交付计划-20260724.md),公司消息现状见[九项能力设计](superpowers/specs/2026-07-24-company-message-nine-capabilities-design.md)与[大喇叭纠偏增量方案](银城大喇叭与问模块纠偏增量方案-20260722.md)。不得把本地影子实现、已部署但尚未完成 Agent 专项生产回归的包存在性,或已验证的全员文件消息和直通车闭环,外推为 Agent 正式验收、消息修订、强触达、工单流转、完整个人知识空间或完整试点已经完成。
“问”模块的产品边界见[《数字师傅工作 Agent 总体设计》](superpowers/specs/2026-07-24-digital-master-agent-design.md),现役旧链路的实施与验证进度见[《实施计划》](superpowers/plans/2026-07-24-digital-master-agent.md);2026-08-04 Grounded Agent 已在现役文本入口受控切换为 `ACTIVE`,仅覆盖符合门禁的 `KNOWLEDGE_QA` 与 `LIVE_MY_WORK`,媒体、资源、外网、写入、训练和不合格计划继续走旧链路,其架构与运行边界以[专项 TechSpec](AIHR_GROUNDED_AGENT_TECHSPEC.md)和[ADR-002](adr/ADR-002-GROUNDED-AGENT-EXECUTION.md)为准。认证态用户逐例问答、客户端状态 UI 全量验收和人工黄金集召回评测仍未完成。工作助手相关术语、实施状态与文档关系集中在[《工作助手与今日工作成果迭代计划》](工作助手与今日工作成果迭代计划-20260721.md)。阶段一“练”的唯一后续施工范围见[《AI陪练完整交付计划》](AI陪练完整交付计划-20260724.md),公司消息现状见[九项能力设计](superpowers/specs/2026-07-24-company-message-nine-capabilities-design.md)与[大喇叭纠偏增量方案](银城大喇叭与问模块纠偏增量方案-20260722.md)。不得把受控 ACTIVE、已部署但尚未完成 Agent 专项生产回归的包存在性,或已验证的全员文件消息和直通车闭环,外推为 Agent 全量正式验收、消息修订、强触达、工单流转、完整个人知识空间或完整试点已经完成。
## 当前项目文档
@@ -32,7 +32,7 @@
| [FIGMA需求覆盖与版本偏差审计-20260717.md](FIGMA需求覆盖与版本偏差审计-20260717.md) | 旧版功能、已确认需求、Figma 实际画板与当前实现的四方对照,以及防止遗漏旧功能和误拉后续阶段的事实源规则 |
| [DEMO_ACCEPTANCE.md](DEMO_ACCEPTANCE.md) | 一期 MVP 演示脚本、录屏兜底、MVP 演示流验收清单 |
| [API_INTEGRATION.md](API_INTEGRATION.md) | 后端 API 对接顺序、数字师傅 Agent、正式试点 CSV、移动端训练/复盘、候选资料和 SOP 接口 |
| [AIHR_GROUNDED_AGENT_TECHSPEC.md](AIHR_GROUNDED_AGENT_TECHSPEC.md) | 受约束语义规划、双工具、证据/事实分型、有界执行、逐结论引用和结构化会话状态的本地影子契约;尚未切换现役 API |
| [AIHR_GROUNDED_AGENT_TECHSPEC.md](AIHR_GROUNDED_AGENT_TECHSPEC.md) | 受约束语义规划、双工具、证据/事实分型、有界执行、逐结论引用和结构化会话状态的现役契约;生产仅在有限文本范围 `ACTIVE`,仍记录未完成的认证态和人工黄金集验收 |
| [adr/ADR-002-GROUNDED-AGENT-EXECUTION.md](adr/ADR-002-GROUNDED-AGENT-EXECUTION.md) | 采用 Spring 内受约束工具执行、证据分型和 fail-closed 门禁,不引入自由 Agent 框架的架构决策 |
| [DIGITAL_ASSET_PROCESSING_GOVERNANCE.md](DIGITAL_ASSET_PROCESSING_GOVERNANCE.md) | 企业数字资产从原始保存、规范化、结构化、质量门禁、人工审核到发布、撤回和规则自动化演进的总体方案 |
| [data-quality-audit.md](data-quality-audit.md) | 数据质量、脏数据治理、信任边界、数据血缘与当前本地实施证据的只读审计基线 |
+8 -2
View File
@@ -30,8 +30,14 @@
- `PARTIAL` 只能输出已覆盖 claim slots;零合格证据不调用答案模型。
- 客户端最终按 `DecisionStatus` 展示完整、部分、需补充、无依据和冲突状态。
## 本地验证更新(2026-08-04)
## 本地验证更新(2026-08-04,ACTIVE 发布前的旁路阶段)
- 治理 Qdrant `aihr_knowledge_governed_v1` 已在本地以 MySQL 有效 production fragments 幂等重建:224/224 points 一致,1024 维 Cosine,`BAAI/bge-m3`,payload 治理字段完整。
- 真实 HTTP 仍只启用进程级 `SHADOW` 诊断,旧响应保持用户可见;金额变体、能力查询、CRM 能力边界、待办+流程和第二项材料已通过双工具/能力工具观测。正式来源缺失时为 `NO_EVIDENCE` 或 `PARTIAL`,不调用答案生成模型。
- 当时真实 HTTP 只启用进程级 `SHADOW` 诊断,旧响应保持用户可见;金额变体、能力查询、CRM 能力边界、待办+流程和第二项材料已通过双工具/能力工具观测。正式来源缺失时为 `NO_EVIDENCE` 或 `PARTIAL`,不调用答案生成模型。
- 最近样本 Planner 约 1.4-4.1 秒、shadow 总耗时约 3.1-7.3 秒,默认 4 秒仅是旁路保护预算,不是生产 SLA。尚未具备客户端灰度接管条件,也没有在缺少 100-300 条人工黄金集时宣称召回率达标。
## 当前运行态(2026-08-04)
在保留上述隔离、回退和证据门禁原则的前提下,生产已通过受控发布将 `AIHR_AGENT_GROUNDED_MODE` 设置为 `ACTIVE`。当前只接管符合严格计划的文本 `KNOWLEDGE_QA` 与 `LIVE_MY_WORK`;媒体、资源、外网、写入、训练及不满足门禁的请求继续使用旧 Orchestrator。生产 JAR SHA-256 为 `74d0cd2acc60ebf52f20eb8bee643f59395ba7cff3583076d671e57406f824ac`,服务为 `active`,schema 预检 `83/83`,公开接口预检通过。
这不是对原决策中“先影子验证、再受控接管”原则的否定,而是该迁移顺序的当前阶段。认证态用户逐例问答、客户端状态 UI 全量验收和 100–300 条人工黄金集仍未完成;在这些证据补齐前,不宣称生产召回率达标,也不视为完整客户端灰度。
@@ -12,7 +12,7 @@
> v1.8 发布前本地实施快照:项目名称选择、项目化会话、确认记录来源/状态、员工今日成果、主管项目成果和“成果投稿”界面名称已完成本地实现与 390×844 验证;该快照记录的是发布前状态,外部线索、工单和考勤投递仍保持 PENDING。
> v1.9 发布与本轮回填: v1.8 所列多项目、项目化确认采集、来源/状态、员工今日成果、主管项目成果和“成果投稿”界面名称已于 2026-07-21 部署。成果历史日期选择、服务端拒绝未来日期及主管手机号授权兜底已于 2026-07-22 发布,并完成远端服务、schema 与产物匹配复核;外部线索、工单和考勤投递仍保持 PENDING。
> v2.0 实施快照:“问”改由 `/api/aihr/agent/**` 统一规划意图并执行受控工具,知识 RAG 退回底层能力;新增 `aihr_agent_run` 最小路由审计。该增量已完成自动化、H5 构建和部分 390×844 浏览器验证,并随 2026-07-25 完整包部署;移动身份失败关闭语义又包含在 2026-07-29 定向发布的生产后端中。正式账号完整业务和真机验收仍未完成。
> v2.1 本地影子增量:2026-08-04 新增 Grounded Agent 核心契约、`MY_CURRENT_TASKS + KNOWLEDGE_SEARCH` 双工具、证据/事实分型、有界执行、逐结论引用和结构化会话状态;现役 `/api/aihr/agent/**` 仍由 v2.0 路径生成用户可见响应,新运行时只在文本响应完成后以默认关闭的异步 SHADOW 旁路执行,未切流、未部署。详细契约见 [AIHR_GROUNDED_AGENT_TECHSPEC.md](AIHR_GROUNDED_AGENT_TECHSPEC.md)。
> v2.1 受控生产增量:2026-08-04 新增 Grounded Agent 核心契约、`MY_CURRENT_TASKS + KNOWLEDGE_SEARCH` 双工具、证据/事实分型、有界执行、逐结论引用和结构化会话状态;生产仅在文本 `KNOWLEDGE_QA`、`LIVE_MY_WORK` 且通过计划、授权和证据门禁时使用 Grounded 运行时,其余请求回退 v2.0 路径。仓库默认仍为 `OFF`,详细契约见 [AIHR_GROUNDED_AGENT_TECHSPEC.md](AIHR_GROUNDED_AGENT_TECHSPEC.md)。
> 配套:需求见[《物业AI人力资源系统业务需求文档BRD》](物业AI人力资源系统业务需求文档BRD.md);2026-07 MVP 执行计划已归档到[《AI人力资源系统一期MVP版作战清单》](archive/2026-07-mvp-delivery/AI人力资源系统一期MVP版作战清单.md)。
> **优先级图例**:`P0`=2026-07-05 MVP 演示必需 · `P1`=一期必需 · `P2`=二期/推迟。
> 决策基线:若依基座 / 集中式前后端分离 / 本地登录 / 公有大模型API / 一期RAG / 组织人员外部同步(MVP 用快照) / 数据范围以项目为主体。
@@ -72,7 +72,7 @@ mobile/
| M8 治理/版本/审核 | 支撑 | P1 |
| M9 AI 适配层 | 支撑 | P0 |
| M10 管理驾驶舱/报表 | 分析 | P1 |
| M11 数字师傅 Agent | 业务编排 | v2.0 现役;v2.1 Grounded 运行时仅本地影子验证,未切流 |
| M11 数字师傅 Agent | 业务编排 | v2.0 兼容路径仍在;v2.1 Grounded 运行时已在生产有限 ACTIVE,认证态专项回归和人工黄金集仍待完成 |
---
@@ -368,7 +368,7 @@ POST /api/aihr/agent/actions/{draftId}/dismiss
- 全网工具必须先取得用户本次明确同意;写入只通过 30 分钟有效的 `draftId` 确认/忽略,并复用领域服务的 `expectedVersion + idempotencyKey + saveScope`。`aihr_agent_run` 只记录最小路由元数据。
- 旧 `/api/knowledge/query`、`query-media` 和 `/api/aihr/web-ai/**` 保留为底层/兼容接口。完整请求示例、错误码和当前发布边界见 [API_INTEGRATION.md](API_INTEGRATION.md)。
2026-08-04 的 Grounded Agent 增量不改变以上 HTTP 响应契约:新 `SemanticQueryPlan`、Tool Registry、Evidence Evaluator、DecisionResult 和 Grounded Composer 已在文本请求完成旧响应后通过异步 SHADOW 旁路串联,默认 `OFF`,其结果与失败均不进入客户端;媒体/附件请求跳过。只有完成真实模型/授权知识库回归、客户端状态契约和独立发布验收后,才能逐步接管 v2.0 Orchestrator;不得从旁路存在推断已切流或已部署。
2026-08-04 的 Grounded Agent 增量不改变以上 HTTP DTO 契约:新 `SemanticQueryPlan`、Tool Registry、Evidence Evaluator、DecisionResult 和 Grounded Composer 已在文本请求中串联。生产 `ACTIVE` 只接管符合计划、授权和证据门禁的 `KNOWLEDGE_QA`、`LIVE_MY_WORK`;媒体/附件请求跳过,工具失败或不支持的计划回退 v2.0 Orchestrator。仓库默认 `OFF`,认证态用户逐例验证、客户端状态契约全量验收、真实依赖召回评测和人工黄金集仍是后续门禁,不得把有限 ACTIVE 推断为全量 Agent 正式验收。
---