Agent 调试成了保命配置
角度从 Vercel 把可观测性放到核心优先级切入,讲 agent 产品为什么不是 prompt 工程,而是分布式系统工程。
同一个 prompt 跑两次,结果可能不一样;同一个 agent 跑十分钟,可能撞上函数失败、沙箱超时、API 限流。Guillermo Rauch 今天把话说透了:Agent 是特别难调试的软件,可观测性不是锦上添花,是保命配置。
AI 产品表面像聊天,底层却是不可复现的模型行为加一堆脆弱外部服务。
真正决定 agent 能不能进生产的,可能不是模型更聪明,而是有没有 trace、回放、记忆和失败诊断。
做 agent 产品时,要把日志、trace、record/replay、工具调用状态和失败恢复当成第一版功能,而不是上线后的工程债。