Agent 基础

AI 为什么能读取文件、
调用工具和执行命令

用一次真实动作理解 Tool Calling,而不是把它当成魔法。

预计阅读 10 分钟公开免费核验于 2026.08.19
内容目录 当前:第 06
开始前准备6
Agent 基础5
工具安装与配置6
模型与接口5
进阶专题5
本文目录 3 个部分

大家好,我是云途。模型本身不会直接伸手操作电脑。它先根据任务选择一个工具,再把参数交给宿主程序执行,最后读取工具返回的结果。

一次工具调用包含五步

模型提出调用,宿主执行工具,结果回到上下文,模型再决定下一步。用户提出任务模型选择工具宿主检查权限工具实际执行结果回到上下文
模型提出调用,宿主执行工具,结果回到上下文,模型再决定下一步。
  1. 用户提出任务。
  2. 模型判断是否需要工具,并生成工具名和参数。
  3. 宿主程序检查权限并执行工具。
  4. 工具把成功、失败或数据结果返回。
  5. 模型根据结果继续行动或向用户报告。

权限发生在执行层,不在一句承诺里

“我不会删除文件”是一句语言承诺;只读权限、审批机制、沙箱和备份才是执行层保护。涉及付款、发消息、删除和生产系统时,不能只依赖提示词。

模型负责提出下一步,工具和宿主环境决定这一步是否真的能够发生。

工具失败不等于模型失效

路径错误、命令不存在、网络断开、权限不足和返回格式变化,都可能让工具调用失败。好的 Agent 会读取错误信息、缩小问题并选择安全的恢复动作,而不是重复运行同一条命令。

完成检查

你能看懂 Agent 的动作链了

  • 知道模型与工具执行是两个阶段。
  • 能在高风险动作前检查真实权限。
  • 工具失败时会先读错误信息。

官方依据与延伸阅读

OpenAI function callingMCP concepts