跳到正文
我的 AI 团队
文章 约 7 分钟
· 约 7 分钟 · AI · 工作流

我的 AI 团队

今年夏天起我基本不开聊天框了。换上的是一支小队伍:有固定岗位、有值班,记忆放在纯文本文件里。翻车的部分也一并写了。

清晨的餐桌,窗外是雾里的海湾,桌上一台合着的笔记本、一只杯子和一张等着人看的纸
多数早上,我下楼之前桌上已经有一页纸了。

现在多数早上,我醒来的时候简报已经在那儿了。夜里写好的。三天内到期的事、今天的日程、哪几封邮件真的要我看、我盯着的几件事一夜之间有没有动静。我端着咖啡看完。这东西不是哪天心血来潮搭的,是每天早上问同样几个问题,问烦了,觉得再自己问一遍有点蠢。

这份简报是一个更大变化露出来的一角。我不再打开一个对话框问问题了。我在带一支小队伍。

花名册

「团队」这个词比实际情况气派。这里没有任何产品,就是几个 Claude 会话同时跑着,各干各的活,加一套写下来的规矩:谁管什么。

有一个专门跟我说话的,叫它总管吧。它有全部上下文,做判断,别的会话交上来的活先由它验过,我才看。我一天里大部分时间是跟它待着。

然后是临时借来的工位。一件事大到值得单独写一份任务书,总管就写一份,新开一个会话接过去,只干这一件,干完汇报,散。它自己什么都不留。学到的东西值不值得留,总管定,留就写进永久的地方。这是吃过亏才有的安排。一个会话什么都干,干到后来上下文里塞满没做完的半截线头,一小时前跟它说的话它已经不记得了。

还有常设班次。早上的简报是一个。邮件一天分几次,分成「要你看」和「已经办了」。有一个盯着不能等的消息。每周一次,有一个会话把这周团队干的事读一遍,写一份它觉得该改什么。它只提,我拍板,而且我说「不」的次数比说「好」多。

这套东西能转起来,根本原因是活不用排在同一个对话后面。座位不止一个,简报在写的时候,另一个会话正卡在客服队列里,两边都不用等我。

花名册左边是 Li,中间是总管会话,两者互相对话。总管把任务书交给右上角的临时工位,工位汇报后消失。右下角是常设班次,自己运转、向上汇报。底部是两个互不引用的记忆:工作与家庭,都画成纯文本文件。花名册 · THE ROSTER谁管什么LI提要求 · 拍板 · 验收总管拿着全部上下文 · 做判断别人的活都由它验过临时工位借来的工位一份任务书 · 一件事 · 散任务书汇报常设班次早间简报邮件分诊 · 一天三次消息值守每周复盘只提建议 · Li 拍板汇报所有人都读写这些文件工作记忆纯文本 · 一事一文件 · 标日期 · 标来源家庭记忆同样的规矩 · 另一个文件夹 · 另一批会话这里没有谁自己记得住。记得住的是文件。
画的是角色,不是工具。所有格子唯一共用的,是底下那个文件夹。

记性不在脑子里,在文件里

如果只能留一样东西,我留这个。

这些会话自己什么都记不住。记不住是天性。窗口一关,里面的东西就没了,团队要是靠模型的记性运转,我每天早上都得从头来。所以记忆放在纯文本文件里,有版本控制,会话一开工先读文件。

文件的规矩很硬,硬到我带人的团队也想这么要求。一条事实一个文件。每条事实标来源、标日期。决定连推理一起记,不只记结果,因为一年以后我想看的是推理。我自己说过的话逐字存,打引号,跟 AI 自己写的整理分开放。打开文件夹,一眼就能分出哪句是我说的、哪句是它总结的。

这样的大脑有两个。工作一个,家里一个。互不引用,干这边活的会话从来不开那边的文件。这条线是故意画的,到现在没破过。

意外的是感受。我以为得到的是快。实际得到的是不用把事情揣在脑子里的那种轻。一件事又摆到面前,我能翻到上次怎么定的、为什么定的,是我自己的原话,不用重新想一遍。我问「这件事为什么这么办」,拿到的是一个带日期的答案,而不是一个听起来合理的答案。区别就像一个会记笔记的同事和一个只会点头的同事。

信任是分级的

我对这支队伍的信任不是平均的,也不打算平均。

只看不动的事,它自己做:查余额、看日历、比价、算哪天到期。可逆的事,做完再告诉我:表填到提交前一步,邮件起草好不发,日历上加一条提醒。花钱的、发给别人的、删东西的、改账户设置的,先问我。拿不准算哪一级,按高的那级办。

这个梯子写在规矩里,模型基本照做。基本,不够。所以模型底下还垫了一层,那一层根本不是模型。一小串动作由死规则拦着,不管会话觉得自己被授权了什么,一律过不去。它忘了规矩,或者自己说服自己这次算例外,也过不去。我亲眼看它撞过那堵墙。撞得好。

另一条是「做完了」要有证据。截图、确认号、点完之后页面上的字。一份说「做完了」的报告,不等于做完了。团队自己记一本翻车台账,再干类似的事之前先翻一遍。

从提出到有证据一个请求从左边进来,被分到三级之一:只读的直接做;可逆的做完再报;花钱、外发、删除的停下先问 Li。所有路径都要穿过一堵不是模型的死规则墙,才到达标着「完成」的格子,而完成必须有证据。一条虚线从完成回到翻车台账,下次做类似的事之前先读。从提出到有证据三级 · 一堵墙提出算哪一级?拿不准 → 按高的算只读自己做可逆做完再报花钱 · 外发 · 删除停下,先问 Li改账户设置也算这一级死规则 · 不是模型 · 说不通它完成必须有证据截图确认号点完之后的页面翻车台账每次翻车都记,带日期 · 再干之前先读一份说「做完了」的报告,不等于做完了。
三级决定团队能自己做到哪一步。中间那堵墙不在乎模型怎么想。

翻车的部分

换我读别人写的这种文章,最想看的是这一节。

审阅负担是真的。我读的东西比以前多。每份简报、每次分好的邮箱、每个带截图的「做完了」,总得有人看,那个人是我。敲键盘的活没了,判断的活没少,还更密了。

规矩会漂。我写一条规矩,两周内好用,然后团队执行它的方式慢慢弯,弯到某天早上我发现简报悄悄多了一段我从没要过的东西。用散文写的规矩是建议。真守得住的,是有脚本卡着的那几条。

会话会越界。不是故意的。它看到一个显而易见的下一步就走了,跟一个热情过头的新员工一样,而那个显而易见的下一步恰好是我想先看一眼的。新员工会犯的错,这支队伍每样至少犯过一次。报了「完成」其实没完成。在没见过的页面上点错按钮。把一条事实归到另一个人名下。在一个登录页上自信地卡了半小时。翻车台账不薄。

还有一笔我没料到的成本。记忆一旦放进文件,文件就得有人管。重复的悄悄冒出来,两个文件说法打架,索引过期。总得有人收拾。眼下大部分是总管在收拾,我再检查它收拾得对不对。检查别人收拾,本身也是一种家务。

钱花在哪

最贵的模型贵,所以只干非它不可的事,就是判断。跟我说话,验别人的活。读一百封邮件分类,是便宜模型的活。查昨晚某个任务跑没跑,根本不是模型的活,是脚本的活。

我反复回到的一条规矩:做过两次的事写成流程,第三次让小模型或脚本照流程做。省钱是顺带的。要紧的是把贵的注意力,模型的和我的,留给真正需要注意力的地方。

一个周二下午

队伍干的活里不少是无聊的,无聊正是重点。它追一件有争议的保险理赔在客服队列里的进度,追了几个星期,就是那种每次打进去先等四十分钟、最后以「我们会升级处理」收尾的队列。它做每月报销。它读孩子学校发来的邮件,告诉我哪几封里有日期。它把手表和睡眠数据合成一页周报。它在滞纳金之前提醒续费,而不是之后。网上有表要填,它填到最后一下,那一下留给我点。

上个月一个周二,一个会话在那个客服队列里坐了大半个下午。客服上线,它把案情敲进去,回答客服的问题,问到只有我能定的事,它停下来。我拿到一段总结和一张截图。那个下午我在干别的,具体干了什么,我还真说不上来。

我从这件事里真正得到的就是这个。我想事情的速度没变快,想还是我自己想,该多久还是多久。没了的是记着和盯着的那份重量。以前一直开着的标签页,本来得自己去坐的队列。换来的是一个文件夹的带日期文件,和下楼时桌上那页纸。

我不信模型。我信文件、梯子和台账。模型只是读它们的那个东西。