Agent 百科

词条目录 · 按主题检索,不按教程顺序

这里按「Agent 是什么、由哪些零件组成、常见模式和风险」来立词条,而不是一条必须读完的教程。想动手实现时,再走下面的学习路径。

学习路径

从 0 实现一个 Agent

聊天机器人 → Harness → 本地工具 → MCP → Skill → RAG。按章节顺序写代码。

打开路径 →

边界与总览

先分清 Agent 和相邻概念,避免后面所有词条糊成一团。

  • Agent能多步决策、调用能力、在停止条件前持续行动的系统撰写中
  • Chatbot多轮对话,默认不行动;Agent 的前身与底板
  • Workflow预定义步骤的流水线;和 Agent 的「现场决定下一步」相对撰写中
  • Autonomy自主程度:建议、需批准、可连续行动撰写中
  • Code Agent以读写代码、跑命令为主的 Agent 形态撰写中
  • Computer Use操作图形界面 / 浏览器,而不仅是 API 工具撰写中

模型与对话

脑子本身:怎么说话、怎么被约束、上下文如何计费。

  • Messagessystem / user / assistant / tool 消息协议撰写中
  • System prompt全局人设与边界;和 Skill 的按需说明书不同撰写中
  • Context window一次能塞进模型的上下文上限撰写中
  • Token计费与截断的基本单位撰写中
  • Streaming边生成边输出;Harness 事件流的来源之一撰写中
  • Structured output强制 JSON / Schema,减少胡写参数撰写中
  • Samplingtemperature 等解码参数对工具调用稳定性的影响撰写中
  • Multimodal图、文件、截屏进入对话后的工具与注入风险撰写中

运行时 Harness

套在模型外面的壳:会话、循环、权限、轨迹。智能很大一块在这里,不在权重里。

  • Harness运行时:托管一次 run,调度模型、工具、Skill、MCP、RAG撰写中
  • Run / Session一次任务与一次会话的生命周期、落盘与恢复撰写中
  • Agent loop思考 → 行动 → 观察,直到停止或触顶撰写中
  • Cancellation人打断、超时、步数上限如何停干净撰写中
  • Trace / Event统一事件:文本、工具、错误,供人看和调试撰写中
  • Compaction窗口满了之后的裁剪、摘要、保留 system 与工具结果撰写中
  • Checkpoint中途失败后从哪一步接着跑撰写中

工具与行动

进程内的手:模型伸手,Harness 执行。

  • Tool可调用的行动接口,有名字、参数、返回给模型的观察撰写中
  • Function calling模型用 Schema 点名工具并填参撰写中
  • Tool result执行结果如何写回对话;过长时如何截断撰写中
  • Parallel tools一轮里并行多个互不依赖的调用撰写中
  • Retries超时、瞬时失败、幂等与否撰写中
  • Dead loop同一工具空转、编造工具名、永不停止撰写中

MCP

进程外的手:用协议插上别人的工具、资源和提示。

  • MCPModel Context Protocol:客户端与服务器交换 tools / resources / prompts撰写中
  • MCP Server暴露能力的一侧,常见 stdio 或 HTTP撰写中
  • MCP ClientHarness 作为客户端:握手、列工具、调用并并入 Loop撰写中
  • MCP Resources可读的资料句柄,和检索、文件工具的边界撰写中
  • MCP Prompts服务端提供的提示模板,和 Skill 的差别撰写中
  • MCP Sampling服务端反过来向客户端要一次模型补全时的风险撰写中

Skill

按需加载的专项流程,不是新工具,也不是 RAG。

  • Skill带名字与说明的说明书(可附脚本),用到才读全文撰写中
  • SKILL.md约定格式:frontmatter + 正文指令撰写中
  • Progressive disclosure先暴露目录级说明,匹配后再注入详细步骤撰写中
  • Skill scripts说明书附带的可执行步骤,仍走工具或 MCP 通道撰写中

知识与记忆

模型没读过的材料,以及跨轮要记住的东西。

  • RAG检索增强:先找片段再生成,减少瞎编私有知识撰写中
  • Chunking切片策略:按标题、长度、重叠撰写中
  • Embedding向量化与 top-k 召回撰写中
  • Hybrid search关键词 + 向量,对付专有名词撰写中
  • Citation答案指回片段;未提及要明说撰写中
  • Memory工作记忆、会话记忆、长期记忆的分层撰写中
  • Scratchpad任务中的草稿区,给模型和人看中间状态撰写中

规划与多 Agent

单循环不够时怎么拆任务、怎么把活交给另一个循环。

  • Planning先列计划再执行,和纯 ReAct 现场发挥的差别撰写中
  • ReAct推理与行动交错的经典循环形态撰写中
  • Reflection做完后自检、改计划,防止一条路走到黑撰写中
  • Todo list把多步任务外化成清单,减少遗忘撰写中
  • Subagent独立的一次 run,带自己的上下文和工具子集撰写中
  • Handoff把对话或任务交给另一个角色 / Agent撰写中
  • Orchestrator总控:拆活、汇总、处理失败,自己少动手撰写中

安全与权限

能行动之后,默认不可信;尤其是工具读回来的内容。

  • Permissions读文件、上网、写盘等能力开关撰写中
  • Sandbox命令和文件访问的隔离边界撰写中
  • Human in the loop高风险工具先审批再执行撰写中
  • Prompt injection用户或页面里的指令劫持 Agent 目标撰写中
  • Indirect injection工具结果、检索片段里藏指令撰写中
  • Data exfil被诱使把密钥、仓库内容送到外网撰写中

评测与工程

能跑不等于可靠。回归、可观测、成本都是百科该收录的。

  • Evaluation固定题:会不会停、选对工具、不编造、不越权撰写中
  • Benchmarks公开基准能说明什么、不能说明什么撰写中
  • Observability日志、轨迹、回放一次失败的 run撰写中
  • Costtoken、工具次数、MCP 往返如何控撰写中
  • Rate limit限流、退避、失败降级撰写中
  • Model routing简单步骤用小模型,难步骤再用强模型撰写中
  • Idempotency工具重试会不会重复下单、重复写文件撰写中

生态对照

别人的产品是现成 Harness,用来对照零件,而不是本百科的实现依赖。

  • 框架LangChain 等:少写样板,也容易把零件藏起来撰写中
  • 产品 HarnessCursor、Claude Code 这类:权限、Skill、MCP 如何长在产品里撰写中