Agent 架构设计
一、起因:LLM 一次调用不够
我做了个工具—— text2everything.vip 自然语言描述流程,LLM 出 Mermaid 代码,右边实时渲染。
第一版是单次调用:用户输入 → LLM → 出图。跑了几个月发现两类问题:
- 语法错了没救 —— LLM 生成的代码看着对,Mermaid 渲染直接
Parse error,用户看到红色堆栈就走了。 - 语义偏了不自知 —— 用户说”画个登录流程”,LLM 惯性给你加个”发送验证码”,既不问,也不告诉你它加了。
这两个问题都不是”再调 prompt”能治的:第一次失败得有第二次机会;补常识没错,但必须留痕才能审计。
所以第二版做成一个 agent:能多轮对话,能自己纠错,能记住用户说过什么。这篇讲一下这个 agent 长什么样。