Skip to content

AI 全栈知识库

Agent 实践

从零实现一个可检索、可恢复、可评测、可安全交付的生产级知识 Agent。18 篇文章

一、定义系统

01|定义生产级知识 Agent 的边界从答案契约、可信边界和非功能目标开始,而不是从调用模型开始。02|领域模型与状态机把会话、回合、证据、声明、策略和发布版本建模为可持久化状态。

二、构建知识

03|文档解析、OCR 与内容保真统一处理文本、HTML、PDF 和 Office 文档,并识别需要 OCR 的失败页面。04|语义切片与质量门禁保留标题、表格、列表和上下文关系,用可量化门禁阻止坏切片发布。05|向量化、索引版本与原子发布隔离构建中索引与在线索引,用版本钉住一次回答看到的知识快照。

三、检索证据

06|混合检索、查询规划与重排组合精确标识、全文、向量、表格和范围检索,并为失败设计降级。07|ACL、范围快照与证据隔离让权限约束进入每条检索分支、缓存键、引用和评测,而不是回答后过滤。

四、编排 Agent

08|LangGraph 状态、节点与 Reducer用显式状态和合并规则组织并行节点,避免共享可变状态和隐式控制流。09|并行研究、融合与补充检索设计 fan-out/fan-in、证据去重、覆盖率计算和有上限的研究回路。10|Claim 级证据绑定与回答修复先规划可核验声明,再逐条绑定证据、合成答案并执行确定性校验。

五、上下文与工具

11|工具、MCP 与不可信结果把工具输出视为数据,用契约、超时、幂等、权限和注入检测包住副作用。12|上下文预算、滚动摘要与记忆在不可变会话记录之上编译模型上下文,区分近期消息、摘要和可删除长期记忆。

六、可靠运行

13|持久化回合、幂等与并发准入先持久化再执行,用唯一键、租约和所有权锁保证一次回合只被一个执行者推进。14|Checkpoint、取消、超时与故障恢复区分业务状态、图检查点和事件日志,实现不重放已完成副作用的恢复路径。15|SSE 流式事件、断线重放与背压以数据库事件序列为真相源,用 Redis 只做低延迟通知并支持 Last-Event-ID。

七、质量与交付

16|Agent Eval 与回归门禁同时评测召回、权限、引用、事实、延迟、模型调用次数和注入防御。17|Trace、指标、成本与策略治理贯通 HTTP、模型、检索、图节点和持久状态,用版本化策略控制成本与质量。18|容器化交付、迁移、旁路验证与回滚把数据库迁移、候选环境、健康门禁、流量切换和恢复演练写进发布协议。