工作方式

← 返回栏目

我和 Agent 的分工边界

我正经用桌面 Agent 干活,是从今年五月底开始的。更早也试过:拿它的报告功能生成一份报告,形式有了,内容却进不了真实工作。那时候我对这类工具的印象,还是能操作网页、整理文件,但谈不上真能干活。

五月底重新上手,体感变了。后来我去福建一个乡村参加黑客松,两天里,从理解业务逻辑、梳理口径、定义指标,到功能上线、通过验收,方案前后迭代了六版,基本就我一个人。Agent 补上了我欠缺的技术执行,我第一次发现,一个人真能在很短的时间里把一条数据链路跑起来。

代价也是真的。那两天每天干十二个小时以上,手指开始脱皮,当地的小黑虫咬得人半夜痒醒。那不是正常工作状态,是身体进入应急状态撑出来的短期爆发。

真正的坑也在这里。Agent 一旦显得能干,我很容易把“它能继续跑”误当成“这件事值得继续跑”,把速度当成效率。活确实出了不少,人也被它带着不停往前冲。Agent 不会在我手指脱皮的时候提醒我:今天到这里就够了。

后来我又用 Agent 重做内容生产方式,把个人知识库从老平台迁到 Obsidian 和飞书。它确实补上了我的技术短板,让很多原来停在想法里的东西第一次能落地。但也正因为它能做,我得重新回答:哪些该交给它,哪些不能。

有次我专门做了一次调性压力测试:先抛一个开放问题,等 AI 洋洋洒洒说完,我全盘否定,再拿两个同类产品作参照,说“你不是它们”。我想看的不是它能不能继续生成,而是被否定以后,它会辩解,还是能收住、认错、接着聊。最后我才揭开:这是一场测试。

那次之后我更确定一件事:AI 可以干很多活,但“什么是好、什么经不起推敲”,这把尺子必须握在我手里。

所以现在我把两个角色拆开:一个 Agent 负责把想法落成代码、做集成和收口;另一个只做只读评审,不碰文件,专门查前一个有没有跑偏。我在最后拍板。写东西的人不能同时证明自己写得对,哪怕写东西的不是人,这条规矩也一样。

我现在划的边界很简单。执行可以交出去:扫文件、写代码、做初稿、跑批量。目标为什么这样定、资料能不能信、做到什么程度算好、什么时候该停,这些留在我这里。

这条边界并没有一次画完。我现在还是会被速度带着跑,也仍然会把本来可以自己十分钟做完的事,绕远路交给 Agent。它能帮我写代码、迁知识库、搭原型、处理大量材料,但它不能替我睡觉,也不能替我判断什么时候该停下来。