NOTES / 思考
记录那些没有
标准答案的问题。
写下我在真实经历中形成、又不断被修正的判断。不限定主题,但只收录写完并愿意为之负责的文章。
9 MIN READ
Agent 工程 · 质量评估
Agent 评估体系最容易踩的四个坑
我设计过一套 Agent 静态质量评分体系,过程中踩了四个坑:把运行态属性塞进静态评估、默认打分能预测上线效果、指标看起来 MECE 实则重复扣分、把交互摩擦当成使用深度。这篇记录每个坑的根因和解法。
7 MIN READ
周年回顾 · 成长与实践
入职一年:我从 Workflow 走到了 Agent
入职第一年,我亲历了 AI 从“被流程包裹”到“自主设计流程”的切换。这篇周年回顾,记录一次亲手完成的迁移,和一个仍然成立的技术判断。
8 MIN READ
企业 AI · 价值衡量
AI 调用次数,为什么不等于业务价值?
调用量只能描述 AI 系统的活跃度。我从指标博弈、价值验证与生产力红利分配三个角度,讨论企业应该如何衡量 Agent 的真实业务价值。
5 MIN READ
生日随笔 · 成长与生活
24 岁:进步、温柔与纪律
我在 24 岁生日写下的一篇生活随笔:重新理解进步与温柔,并以纪律、第一性原理和长期主义面对不确定性。
12 MIN READ
Agent 工程 · 源码拆解
Claude Code 源码中的 8 套 Agent 设计模式
我读完 Claude Code 的 1884 个还原源文件,提炼出 8 套 Agent 设计模式。最深的启发不是编排技巧,而是“防止 AI 偷懒”如何被做成工程。
14 MIN READ
AI 机制 · 跨学科观察
当 AI 开始做梦:AutoDream 与人类睡眠的趋同进化
我从 Claude Code 状态栏里的 dreaming 切入,拆解 AutoDream 记忆整理的机制,并对照人类睡眠的神经科学:这不是模仿,而是同一约束下的趋同进化。