智能体工具调用模式
模式定义
精确定义:智能体工具调用(Agent Tool-Calling)是一种推理模式,其中模型配备一组可执行函数模式(工具),通过输出有效的 JSON 对象供外部执行,从而弥合文本生成与结构化操作之间的差距。
待解决的问题
自然语言本质上是“模糊的”,但 API 是严格确定性的。AI 智能体的主要故障点在于“交接幻觉”(Handoff Hallucination),即模型尝试使用错误的参数、不存在的键或格式错误的 JSON 来调用函数。对于工程总监而言,这正是 AI 的“氛围”与生产稳定性现实交汇之处。正如在《谁来审计审计师?》(Who Audits the Auditors?)中所指出的,如果你的智能体无法可靠地触发工具,那么它就无法被审计,更不用说被信任去处理 Sovereign Vault 中的高完整性数据。
使用案例
考虑一个档案智能体(Archival Intelligence agent),其任务是检索特定 1880 年代航运账册的数字孪生体。模型决定需要查看“Ledger-402”的原始扫描件。该工具是一个摄影测量检索函数,需要特定的 UUID 和分辨率参数。如果没有严格的工具调用模式,模型可能会猜测 UUID 或忘记分辨率,导致静默失败。有了该模式,系统强制实施严格的模式契约:模型要么提供与函数要求相匹配的有效 JSON 调用,要么在错误到达数据库之前触发立即的自我纠正循环。
解决方案
可靠的工具调用需要“闭环”架构:
- 模式定义:为每个可用工具提供精确的 JSON Schema 定义。
- 工具选择:模型输出
tool_call而不是纯文本。 - 执行与反馈:应用程序执行代码并将原始结果反馈给模型,使其能够“看到”其操作的结果。