2025 年 7 月,我入职了第一家公司,头衔是 AI Agent 工程师。但我独立完成的第一个系统,与其说是 Agent,不如说是 workflow——大模型只是其中一两个节点。

01 / THE BEGINNING

一年前的开始:AI 是被包裹起来的

那时的基础模型远没有今天可靠:让它自主规划一个多步任务,它会在第三步走丢;让它自己调用工具,参数里的编造成分不小。在企业生产环境里,这种不确定性是不能被接受的。

所以当时的主流做法,是把智能切碎:人先设计好一条固定的流程,大模型只在其中一两个节点上做受控的发挥——分类、摘要、打分、提取。流程的每一步都是确定的,智能被包裹在里面,跑不出轨道。

我最初做各种各样的智能体,都是在 Dify 上搭的:拖出节点、连上线、配上提示词,一个 workflow 就是一个应用。现在回头看,那时的“AI 应用开发”与其说是设计智能,不如说是设计流程——模型能力被默认是有限的,工程师的工作是围绕这种有限性做补偿。

02 / A SPECIMEN

舆情系统:一个 workflow 时代的标本

我入职后的第一个业务项目,是一套舆情分析系统。

舆情分散在全网各个主流平台上,每天新增上千条。这个量级靠人工处理不过来——不是因为单条难,而是因为任何事情乘以一千,都会变成另一件事。

我的做法是先用一条 ETL 管道把舆情全部收进来——这部分完全确定,与 AI 无关——然后让一条 workflow 接手分析:清洗、分类、提取关键信息、判断情感倾向、聚类出值得关注的主题。大模型在其中只是几个受控节点,每个节点只做一小步,输入输出都有明确格式。

上线后,过去人工无法覆盖的每日舆情,变成了可以自动读完、自动汇总的日常工作流。节省的时间是真实的。

但今天我再看这套系统,会看到当时看不到的另一面:它的智能上限,在我画完最后一个节点的那天就被封死了。它只会按我设计的步骤思考;步骤之外的判断,它一步也做不了。

03 / THE TURN

转折点:模型开始自己走路了

2025 年下半年,事情开始变化。基础模型的能力跨过了某条线:多步规划不再轻易跑偏,工具调用变得可靠,模型甚至开始能在发现自己的错误之后纠正回来。Claude Code 这类 Coding Agent 让我第一次直观看到另一种形态:没有人给它画流程图,它自己决定先做什么、后做什么、什么时候回头检查。

我的工作方式也跟着迁移:从手写代码,变成多个 Agent 并行执行;从在 Dify 上连节点,变成用代码原生地编排 Agent。过去要精心设计流程才能约束住的模型,现在可以交给它一个目标,让它自己拆解、执行、验证。

迁移不是某一天发生的。但当我意识到的时候,去年那套做法已经成为了旧做法。

04 / SCAFFOLD AND CEILING

脚手架与天花板

一年里我反复想这件事,现在的判断可以写成三句话。

第一句:workflow 的本质,是把模型的不确定性关进流程的笼子。弱模型时代,笼子是保护——没有它,模型进不了生产环境。

第二句:模型在变强,笼子不会跟着变。每个写死的节点,都是“模型当时只能做到这里”的快照。模型每升级一次,快照就贬值一次。workflow 的上限是设计者的想象力,agent 的上限是模型的能力——前者不会自己涨,后者一直在涨。

第三句,也是最锋利的一层:流程正在从资产变成产物。workflow 时代,流程是值得精心维护的资产;agent 时代,流程是模型按任务即时生成的产物,用完即弃。“AI 可以自主设计流程”的真正含义,不是 AI 也会画流程图了,而是流程本身不再值得被固化。

Workflow 是弱模型的脚手架。模型变强之后,脚手架就成了天花板。

05 / THE BOUNDARY

流程没有消失,只是换了主人

但我不想把话说绝:workflow 没有死。

在高合规、零容错、强审计的场景里,笼子仍然是正确答案——那些地方恰恰不希望模型有任何自由发挥。变的不是“流程要不要存在”,而是“流程由谁设计、为谁负责”。把控制权交给模型,也不等于放弃控制,只是控制从“规定每一步”上移到“验证每一步”——这也正是我目前工作里投入最多的事情。

同样要诚实的是:Agent 也不是“最强形态”。模型潜力的真正释放靠的是配套——合适的 harness、context engineering、MCP、Skill 这些工具层,决定了模型能发挥出几成。一个裸模型加一个宏大的目标,往往跑不过一个被良好工具链托住的模型。

所以更实际的心法,是按业务情况选择形态:确定性高的重复劳动,脚本最便宜;步骤固定、但需要一点智能的,workflow 最稳;目标开放、路径未知的,才轮到 Agent。技术没有被抛弃,只是不同的场景有各自最适合的技术。工程上的成熟,很大一部分就是这种“不迷信最新形态”的判断力。

06 / YEAR TWO

第二年

迁移还没有结束。按照同样的逻辑,模型下一轮升级会继续吃掉今天精心设计的 workaround——包括我现在正在搭的东西。

一年里学到的最重要的一件事,是不要爱上自己搭的脚手架。

第二年我想追问的问题是:当 Agent 能够自己设计流程,人在系统里的位置是什么?我目前的答案是:从“设计流程的人”,变成“定义目标、验证结果、承担责任的人”。这个答案明年也许又会被改写——如果是,那就对了。

写于 2026.07.30

入职一年最大的底气,不是搭过什么系统,而是敢亲手拆掉它们。

返回全部思考