外部权威资料清单
约 9 分钟 · 更新于 2026-09-01
外部权威资料清单
这份清单的定位
学习路线的每个阶段都列了"已有资料"(本仓已收录的中译与拆解)。本清单补的是外部一手来源:官方工程博客、官方文档、原始论文、标准与安全框架。
检索时间:2026-08-25,通过 Perplexity Search API 分两轮批量检索——首轮 9 次调用 44 条 query 建立索引,补检索 3 轮关闭已知缺口,另用免费检索核实存疑 URL。
性质声明:本清单基于检索返回的正文片段建立,不是全文精读。它回答的是"这篇存不存在、日期是多少、核心主张是什么、值不值得读",不替代读原文。
三条使用规则
- 优先读一手。官方工程博客 > 官方文档 > 论文摘要 > 二手解读。本清单不收录内容营销性质的"2026 最佳实践"类文章。
- 数字类信息去官方核对。模型窗口、价格、限流、规范版本每几个月就变。清单里给的是入口,不是结论。
- 注意日期。每条都标了发布/更新时间。Agent 领域一年前的"最佳实践"可能已经过时(例如 MCP 的会话模型在 2026-07 被整个推翻)。
一、按阶段的精读清单
阶段 0 · 分层与统一词汇
阶段 1 · LLM 基础
阶段 2 · 模型 API 与结构化交互
缓存参数是逐模型列表且持续变动
上面两篇给的是机制与量级。做成本模型时逐条去官方页核对当前在用模型的数字,并在自己的表里记数据获取日期。
阶段 3 · RAG 与上下文工程
阶段 4 · Agent 基础与 Agent Loop
阶段 5 · Tool Use、MCP 与 Skills
阶段 6 · Harness 内核架构
阶段 7 · Runtime 与生命周期
阶段 8 · Memory 与长期知识
阶段 9 · Planning 与 Multi-Agent
阶段 10 · Evaluation 与可观测性
阶段 11 · 安全、权限与治理
阶段 12~14 · 产品、商业化与作品集
二、协议与标准的当前状态(2026-08-25)
这一节是有时效的,每季度应当复核一次
MCP(Model Context Protocol)
- 当前规范版本:2026-07-28,官方称为发布以来最大的一次修订
- 核心变化:协议核心无状态化(移除协议级会话与 Mcp-Session-Id、移除 initialize/initialized 握手)、新增 server/discover、列表结果可缓存且顺序确定、方法名与工具名走 Mcp-Method / Mcp-Name HTTP 头(网关可据此做路由与鉴权)、服务端→客户端请求改用多轮往返(MRTR)而非常开双向流、Tasks 与 MCP Apps 升级为一等公民、授权要求收紧
- 部分特性的弃用状态在二手报道中说法不一,涉及改造决策请以规范原文为准
- 入口:规范主页 · 官方博客
A2A(Agent2Agent)
- 2025-04 由 Google 发布,2026-03 发布 v1.0
- 2026-04 官方公布一周年成果:150+ 组织支持,主流云平台集成
- 2026-08-17 转入 Linux Foundation 旗下的 Agentic AI Foundation,与 MCP 同处一个中立治理机构
- 与 MCP 的分工:MCP 接工具,A2A 接 Agent
- 产品判断:协议正在变成公共基础设施——基础设施不给任何人护城河
OpenTelemetry GenAI 语义约定
- 截至 2026 年年中,GenAI 与 MCP 相关的语义约定仍处 Development / experimental 状态,字段名还会变
- 产品含义:现在可以按 OTel 思路埋点,但预留一层字段映射,不要把字段名硬编码进太多下游依赖
OWASP 的两份 Agentic 清单(别混编号)
Top 10 for Agentic Applications(ASI01–ASI10),2025-12 发布、面向 2026:
| 编号 | 名称 | 官方举的真实案例 |
|---|
| ASI01 | 目标劫持 Agent Goal Hijack | EchoLeak |
| ASI02 | 工具滥用 Tool Misuse | Amazon Q |
| ASI03 | 身份与权限滥用 Identity & Privilege Abuse | — |
| ASI04 | 智能体供应链漏洞 Agentic Supply Chain Vulnerabilities | GitHub MCP exploit |
| ASI05 | 意外代码执行 Unexpected Code Execution | AutoGPT RCE |
| ASI06 | 记忆与上下文投毒 Memory & Context Poisoning | Gemini Memory Attack |
| ASI07 | 不安全的 Agent 间通信 Insecure Inter-Agent Communication | — |
| ASI08 | 级联失败 Cascading Failures | — |
| ASI09 | 人机信任利用 Human-Agent Trust Exploitation | — |
| ASI10 | 失控 Agent Rogue Agents | Replit meltdown |
Agentic Skills Top 10(AST01–AST10) 是另一份独立清单,专门覆盖技能包生态(如 AST09「无治理」)。两份的编号前缀不同,引用时别写混。
CSA 自主等级(六级,对标 SAE J3016)
| 级别 | 名称 | 决策者 | 执行者 | 人的参与 |
|---|
| L0 | 无自主 No Autonomy | 人 | 人 | 每个动作 |
| L1 | 辅助 Assisted | 人 | AI | 逐动作审批 |
| L2 | 受监督 Supervised | 人 | AI | 审批计划/批次 |
| L3 | 有条件 Conditional | AI(边界内) | AI | 越界才上报 |
| L4 | 高度自主 High Autonomy | AI | AI | 监控与异常处理 |
| L5 | 完全自主 Full Autonomy | AI(含自设目标) | AI | 仅战略层监督 |
官方两条建议:L1 是新上手组织的推荐起点;L5 列出只为分类完整,不建议用于当前企业部署。
这套「自主等级」与本路线的「动作风险分级」是两个正交的轴
前者分人参与到什么程度,后者分这件事做错了有多严重。组合方式见阶段 11 讲义第四节。
三、可信度分级:怎么看待"2026 最佳实践"类文章
检索 Agent 主题时,搜索结果里有大量 SEO 内容。本清单刻意排除了它们,但你自己检索时会遇到。分级标准:
| 级别 | 类型 | 怎么用 |
|---|
| A · 一手 | 厂商工程博客、官方文档、规范原文、原始论文 | 可直接引用,注明日期 |
| B · 半一手 | 基金会公告、权威媒体报道、有署名的实践复盘 | 可引用事件与时间线,结论要交叉验证 |
| C · 二手解读 | 技术社区文章、对照评测 | 只用来发现线索,结论回到 A 级核对 |
| D · 内容营销 | "2026 年最佳 X 工具对比""完整指南" | 不引用。尤其是价格、市场规模、采纳率这类数字 |
D 级最常出现在三类话题上
定价模式、工具选型对比、市场采纳率。 这三类话题的搜索结果里,绝大部分是带商业目的的内容。判别方法:样本量说了吗?谁做的调研?口径是什么?说不清就当 D 级。
模式可以借鉴,数字必须自己算。
四、维护约定
- 每季度复核一次第二节(协议与标准状态),改动写在下面的变更记录里
- 新增资料时,标注 出处 · 时间 · 读它拿什么 三项,缺一项不收
- 只收 A 级和 B 级;C 级线索直接去找它引用的一手来源
- 本仓已收录中译的文章,链接到本仓文件而不是外链(见各阶段讲义的"已有资料"节)
变更记录
| 日期 | 变更 |
|---|
| 2026-08-25 | 建立。9 次批量检索(44 条 query),覆盖 Anthropic / OpenAI / LangChain 官方文档、MCP 规范、arXiv 奠基论文、OWASP 与 CSA 安全框架 |
| 2026-08-25 | 补检索 3 轮,关闭首版四处缺口:① ASI07–ASI10 补齐并附真实事件;② CSA 六级自主等级拿到级名与规格;③ 两家 Prompt Caching 官方文档替换掉此前的二手描述;④ 核实并修正两条此前由我推断而非检索所得的 URL。新增 Agentic Skills Top 10、防御设计模式论文、AgentDojo 三个来源。同时把阶段 12 的 Agent UX 模式表明确降级标注为 C 级 |
首版遗留的已知薄弱处(供下次复核时优先处理)
- 阶段 12 的 Agent UX 模式表:截至 2026-08 确实没有一手来源,已标 C 级。若日后有厂商或标准组织发布正式模式规范,优先替换。
- 阶段 13 的定价模式分类:来源全为 D 级内容营销,已按"只描述模式、不引用任何数字"处理。
- 阶段 8 的记忆产品对照:Letta 的 core/archival/recall 三分法目前引自二手,未核对官方文档。
- 本清单全部条目均基于检索摘要片段(400~2500 字符)建立,不是全文精读。它是指路级索引,条目里的"读它拿什么"是导读,不能替代读原文。
- AI 与 Agent 基础知识学习路线
- 术语表
- AI 技术博客索引(本仓已收录的中译文章)
- Anthropic 官方最佳实践汇总