Agent 与工具调用¶
Agent 是以 LLM 为决策核心、能够读取上下文并调用外部工具完成多步任务的系统。它不是“更聪明的聊天机器人”,而是“模型 + 工具 + 状态 + 执行边界”的组合。
组成与关系¶
用户目标 → Agent(规划/判断)
├── Context:对话、RAG 证据、当前状态
├── Tools:搜索、数据库、文件、业务 API、代码执行
├── MCP:工具/资源接入的标准协议之一
└── Workflow:固定步骤、审批、重试和回滚
| 概念 | 解决什么问题 | 何时使用 |
|---|---|---|
| Function Calling / Tool Calling | 让模型以结构化参数请求工具。 | 查询、写入、检索、调用业务 API。 |
| MCP | 统一模型客户端与工具/资源服务器的接入方式。 | 多工具、多客户端、需要标准化接入。 |
| Workflow | 将确定性步骤显式编排。 | 审批、ETL、发布、固定业务流程。 |
| Agent | 根据上下文动态决定下一步工具和顺序。 | 问题路径不固定、需分析和多步探索。 |
落地原则¶
- 工具描述、输入 schema、权限范围和失败返回必须明确;模型不应自行猜测危险参数。
- 读取、草稿、执行、提交分层;删除、发布、外部发送和权限变更必须有审批或用户确认。
- 每次调用记录目标、参数、结果、耗时和关联请求,方便审计与复盘。
- 能用确定性 Workflow 的不要强行用 Agent;Agent 适合决策,流程适合稳定执行。