增强型 LLM:工具、检索与记忆

增强型 LLM:工具、检索与记忆:把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务,通过架构、轨迹和故障重放完成验收。

学习目标

  • 能解释“增强型 LLM:工具、检索与记忆”如何把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务
  • 能区分增强型 LLM、检索、工具、工作记忆、长期记忆,并指出控制权、数据与副作用边界
  • 能固定输入与版本,沿以下证据定位首个分叉:查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用
  • 能注入“检索返回过期资料、记忆混入其他用户状态,模型仍把它们当作可信上下文”,完成阻断、恢复、复位和同输入重放

来源、课程编排与适用边界

“增强型 LLM:工具、检索与记忆”以Anthropic 公开全文《Building effective agents》为总纲,并用Anthropic《Building effective agents》核对本单元机制;涉及 MCP 的控制权边界再由MCP 2025-06-18 官方规范交叉检查。

这不是 Anthropic 出版的“19 章教材”。平台把公开文章、官方工具文档与协议规范重组为 19 个应用单元;下列 152 个节点是站内课程地图,不冒充原文目录。正文、代码、图表、实验和练习均为独立教学重写;产品接口、模型行为或协议版本变化时必须重新验证。

本单元的八个课程坐标

  • 增强型 LLM:工具、检索与记忆:这是“把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务”的第 1 个课程坐标;必须进入机制解释、实验观察或练习证据,不能只停在目录。
  • 先打个比方:这是“把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务”的第 2 个课程坐标;必须进入机制解释、实验观察或练习证据,不能只停在目录。
  • 第一个概念:增强,加的是外面的壳,不是里面的模型:这是“把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务”的第 3 个课程坐标;必须进入机制解释、实验观察或练习证据,不能只停在目录。
  • 第二个概念:检索——先捞对资料,再带着资料回答:这是“把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务”的第 4 个课程坐标;必须进入机制解释、实验观察或练习证据,不能只停在目录。
  • 第三个概念:工具——让它从「只会说」到「真能做」:这是“把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务”的第 5 个课程坐标;必须进入机制解释、实验观察或练习证据,不能只停在目录。
  • 第四个概念:记忆——关掉就忘的,和跨会话还记得的:这是“把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务”的第 6 个课程坐标;必须进入机制解释、实验观察或练习证据,不能只停在目录。
  • 动手看:三路增强如何汇成一次「强」调用:这是“把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务”的第 7 个课程坐标;必须进入机制解释、实验观察或练习证据,不能只停在目录。
  • 用代码看一次增强调用的骨架:这是“把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务”的第 8 个课程坐标;必须进入机制解释、实验观察或练习证据,不能只停在目录。

术语与运行合同

本页不变量是:进入上下文或执行链的增强结果必须有来源、版本、权限和失败语义。任何“成功”结论都要保存以下证据:查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用,模型生成的计划或自信不能替代环境事实。

关键机制与可推翻实验

增强发生在模型外

权重没有因一次检索或工具调用而改变;运行时只是把新证据送入下一次推理。

动手验证:固定模型版本,切断检索后比较可用信息而不是宣称模型被训练。

检索先验收再拼接

相关性、时效、权限和去重共同决定文档能否进入上下文。

动手验证:混入一条高相似但过期文档,验证排序后的确定性过滤。

工具结果也是不可信输入

网络响应、数据库字段和第三方文本都可能为空、超时或包含注入内容。

动手验证:让工具返回缺字段对象,确认校验失败时不进入回答。

记忆必须隔离和可撤销

跨会话状态需要命名空间、过期策略和用户可见的删除路径。

动手验证:用两个租户写入同名键,验证读取结果不串线。

先预测,再操作三类证据

分步1 / 3

1. 架构与复杂度边界

在“增强型 LLM:工具、检索与记忆”中切换简单基线、受控工作流与自主循环,先预测“把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务”在哪个阶段需要增加控制权,再比较延迟、成本、可观测性和自主性。

Architecture decision laboratory

增强型 LLM:工具、检索与记忆

把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务

复杂度档位

不变量:进入上下文或执行链的增强结果必须有来源、版本、权限和失败语义

受控工作流:只激活能够由收益证明的阶段1请求分类2按需检索3工具选择4记忆读写5证据回答蓝色表示当前方案承担的责任;虚线阶段仍留在系统边界外。关键证据:查询、命中文档、工…
自主性46
延迟52
成本48
可观测78

最小可运行实现

async function augmentedCall(request: Request, actor: Actor) {
  const documents = await retrieve(request.query, { actor, limit: 5 });
  const memory = await loadMemory(actor.tenantId, request.sessionId);
  const context = validateContext({ documents, memory });
  const response = await model.generate({
    request,
    context,
    tools: safeTools(actor),
  });
  return { response, provenance: context.sources };
}

这段切片只暴露“把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务”的最小运行合同。交付版本还要补齐超时、密钥隔离、结构化日志、幂等和批量评测;缺少查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用时,代码能运行也不代表本章结论成立。

小结

  • 检索、工具与记忆是接到模型外部的可替换能力
  • 增强结果须有来源、版本、权限和失败语义
  • 检索先验收再拼接,过期或越权文档不能进上下文
  • 工具结果也是不可信输入,须校验空值和注入
  • 长期记忆须隔离租户、可过期、可撤销

练习与答案

练习

问题 1:最小证明。 怎样用最少样本证明“进入上下文或执行链的增强结果必须有来源、版本、权限和失败语义”?

问题 2:课程覆盖。 增强型 LLM:工具、检索与记忆、先打个比方、第一个概念:增强,加的是外面的壳,不是里面的模型、第二个概念:检索——先捞对资料,再带着资料回答、第三个概念:工具——让它从「只会说」到「真能做」、第四个概念:记忆——关掉就忘的,和跨会话还记得的、动手看:三路增强如何汇成一次「强」调用、用代码看一次增强调用的骨架如何进入可操作验证?

问题 3:恢复闭环。 怎样证明“检索返回过期资料、记忆混入其他用户状态,模型仍把它们当作可信上下文”已经修复?

本章回顾

  • “增强型 LLM:工具、检索与记忆”的主问题是把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务。
  • 核心不变量是进入上下文或执行链的增强结果必须有来源、版本、权限和失败语义。
  • 首要反例是检索返回过期资料、记忆混入其他用户状态,模型仍把它们当作可信上下文。
  • 最小证据包包含查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用。

名词解释

本章出现的专业名词,用大白话再讲一遍。

增强型 LLM

接入检索、工具和记忆等外部能力的模型调用。在“增强型 LLM:工具、检索与记忆”中必须能按以下证据重新定位:查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用。

检索

按查询从外部语料取回与任务相关证据。在“增强型 LLM:工具、检索与记忆”中必须能按以下证据重新定位:查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用。

工具

让模型请求外部读取、计算或副作用的结构化接口。在“增强型 LLM:工具、检索与记忆”中必须能按以下证据重新定位:查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用。

工作记忆

当前任务期间保留并可清理的状态。在“增强型 LLM:工具、检索与记忆”中必须能按以下证据重新定位:查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用。

长期记忆

跨会话保存且必须有租户、权限和生命周期的状态。在“增强型 LLM:工具、检索与记忆”中必须能按以下证据重新定位:查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用。

阅读导航

← 从 LLM 到 Agent:什么是智能体 · 智能体循环:感知、思考与行动 →

讨论

评论区加载中…