增强型 LLM:工具、检索与记忆
增强型 LLM:工具、检索与记忆:把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务,通过架构、轨迹和故障重放完成验收。
学习目标
- 能解释“增强型 LLM:工具、检索与记忆”如何把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务
- 能区分增强型 LLM、检索、工具、工作记忆、长期记忆,并指出控制权、数据与副作用边界
- 能固定输入与版本,沿以下证据定位首个分叉:查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用
- 能注入“检索返回过期资料、记忆混入其他用户状态,模型仍把它们当作可信上下文”,完成阻断、恢复、复位和同输入重放
来源、课程编排与适用边界
“增强型 LLM:工具、检索与记忆”以Anthropic 公开全文《Building effective agents》为总纲,并用Anthropic《Building effective agents》核对本单元机制;涉及 MCP 的控制权边界再由MCP 2025-06-18 官方规范交叉检查。
这不是 Anthropic 出版的“19 章教材”。平台把公开文章、官方工具文档与协议规范重组为 19 个应用单元;下列 152 个节点是站内课程地图,不冒充原文目录。正文、代码、图表、实验和练习均为独立教学重写;产品接口、模型行为或协议版本变化时必须重新验证。
本单元的八个课程坐标
- 增强型 LLM:工具、检索与记忆:这是“把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务”的第 1 个课程坐标;必须进入机制解释、实验观察或练习证据,不能只停在目录。
- 先打个比方:这是“把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务”的第 2 个课程坐标;必须进入机制解释、实验观察或练习证据,不能只停在目录。
- 第一个概念:增强,加的是外面的壳,不是里面的模型:这是“把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务”的第 3 个课程坐标;必须进入机制解释、实验观察或练习证据,不能只停在目录。
- 第二个概念:检索——先捞对资料,再带着资料回答:这是“把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务”的第 4 个课程坐标;必须进入机制解释、实验观察或练习证据,不能只停在目录。
- 第三个概念:工具——让它从「只会说」到「真能做」:这是“把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务”的第 5 个课程坐标;必须进入机制解释、实验观察或练习证据,不能只停在目录。
- 第四个概念:记忆——关掉就忘的,和跨会话还记得的:这是“把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务”的第 6 个课程坐标;必须进入机制解释、实验观察或练习证据,不能只停在目录。
- 动手看:三路增强如何汇成一次「强」调用:这是“把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务”的第 7 个课程坐标;必须进入机制解释、实验观察或练习证据,不能只停在目录。
- 用代码看一次增强调用的骨架:这是“把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务”的第 8 个课程坐标;必须进入机制解释、实验观察或练习证据,不能只停在目录。
术语与运行合同
↡增强型 LLM:接入检索、工具和记忆等外部能力的模型调用;在“增强型 LLM:工具、检索与记忆”中按以下证据核对:查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用。、↡检索:按查询从外部语料取回与任务相关证据;在“增强型 LLM:工具、检索与记忆”中按以下证据核对:查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用。、↡工具:让模型请求外部读取、计算或副作用的结构化接口;在“增强型 LLM:工具、检索与记忆”中按以下证据核对:查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用。、↡工作记忆:当前任务期间保留并可清理的状态;在“增强型 LLM:工具、检索与记忆”中按以下证据核对:查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用。、↡长期记忆:跨会话保存且必须有租户、权限和生命周期的状态;在“增强型 LLM:工具、检索与记忆”中按以下证据核对:查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用。。
本页不变量是:进入上下文或执行链的增强结果必须有来源、版本、权限和失败语义。任何“成功”结论都要保存以下证据:查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用,模型生成的计划或自信不能替代环境事实。
关键机制与可推翻实验
增强发生在模型外
权重没有因一次检索或工具调用而改变;运行时只是把新证据送入下一次推理。
动手验证:固定模型版本,切断检索后比较可用信息而不是宣称模型被训练。
检索先验收再拼接
相关性、时效、权限和去重共同决定文档能否进入上下文。
动手验证:混入一条高相似但过期文档,验证排序后的确定性过滤。
工具结果也是不可信输入
网络响应、数据库字段和第三方文本都可能为空、超时或包含注入内容。
动手验证:让工具返回缺字段对象,确认校验失败时不进入回答。
记忆必须隔离和可撤销
跨会话状态需要命名空间、过期策略和用户可见的删除路径。
动手验证:用两个租户写入同名键,验证读取结果不串线。
先预测,再操作三类证据
1. 架构与复杂度边界
在“增强型 LLM:工具、检索与记忆”中切换简单基线、受控工作流与自主循环,先预测“把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务”在哪个阶段需要增加控制权,再比较延迟、成本、可观测性和自主性。
Architecture decision laboratory
增强型 LLM:工具、检索与记忆
把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务
不变量:进入上下文或执行链的增强结果必须有来源、版本、权限和失败语义
最小可运行实现
async function augmentedCall(request: Request, actor: Actor) {
const documents = await retrieve(request.query, { actor, limit: 5 });
const memory = await loadMemory(actor.tenantId, request.sessionId);
const context = validateContext({ documents, memory });
const response = await model.generate({
request,
context,
tools: safeTools(actor),
});
return { response, provenance: context.sources };
}这段切片只暴露“把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务”的最小运行合同。交付版本还要补齐超时、密钥隔离、结构化日志、幂等和批量评测;缺少查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用时,代码能运行也不代表本章结论成立。
小结
- 检索、工具与记忆是接到模型外部的可替换能力
- 增强结果须有来源、版本、权限和失败语义
- 检索先验收再拼接,过期或越权文档不能进上下文
- 工具结果也是不可信输入,须校验空值和注入
- 长期记忆须隔离租户、可过期、可撤销
练习与答案
练习
问题 1:最小证明。 怎样用最少样本证明“进入上下文或执行链的增强结果必须有来源、版本、权限和失败语义”?
问题 2:课程覆盖。 增强型 LLM:工具、检索与记忆、先打个比方、第一个概念:增强,加的是外面的壳,不是里面的模型、第二个概念:检索——先捞对资料,再带着资料回答、第三个概念:工具——让它从「只会说」到「真能做」、第四个概念:记忆——关掉就忘的,和跨会话还记得的、动手看:三路增强如何汇成一次「强」调用、用代码看一次增强调用的骨架如何进入可操作验证?
问题 3:恢复闭环。 怎样证明“检索返回过期资料、记忆混入其他用户状态,模型仍把它们当作可信上下文”已经修复?
本章回顾
- “增强型 LLM:工具、检索与记忆”的主问题是把检索、工具与记忆作为可替换能力接到模型外部,并验证每种增强是否真的改善任务。
- 核心不变量是进入上下文或执行链的增强结果必须有来源、版本、权限和失败语义。
- 首要反例是检索返回过期资料、记忆混入其他用户状态,模型仍把它们当作可信上下文。
- 最小证据包包含查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用。
名词解释
本章出现的专业名词,用大白话再讲一遍。
- 增强型 LLM
接入检索、工具和记忆等外部能力的模型调用。在“增强型 LLM:工具、检索与记忆”中必须能按以下证据重新定位:查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用。
- 检索
按查询从外部语料取回与任务相关证据。在“增强型 LLM:工具、检索与记忆”中必须能按以下证据重新定位:查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用。
- 工具
让模型请求外部读取、计算或副作用的结构化接口。在“增强型 LLM:工具、检索与记忆”中必须能按以下证据重新定位:查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用。
- 工作记忆
当前任务期间保留并可清理的状态。在“增强型 LLM:工具、检索与记忆”中必须能按以下证据重新定位:查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用。
- 长期记忆
跨会话保存且必须有租户、权限和生命周期的状态。在“增强型 LLM:工具、检索与记忆”中必须能按以下证据重新定位:查询、命中文档、工具 schema、记忆键、来源时间、权限判定与最终引用。