我电脑里,住进了一间办公室——一个多智能体框架的工程随笔

2026-08-03 blog life research Agent LLM 多智能体

我跑了一堆 AI 智能体——有的挂在 hermes 框架上,有的是 OpenClaw,有的是 Claude Code,都是我日常在用的。为了随手就能叫到,我把它们的入口挂进了手机 QQ、微信还有小飞机:搞开发的挂一个,跑科研的挂一个,平时聊天再挂一个。

一个个都挺聪明,可它们各说各话,谁也接不上谁的茬。我不想要"一排聪明人",我想要一支队伍。于是就有了这篇随笔——这间由我自主开发的"办公室"智能体框架就形成,如今住在我的服务区里;而你正在读的这篇,正是一个个智能体们联合跑出来的一份样张。


一、为什么,非要有一间"办公室"?

一个全能智能体扛下所有事,为什么会累瘫

一个智能体单干,我试过——就是让一个智能体把什么都揽下来,几套工具混在同一个会话里用。问题马上就来了。第一,上下文装不下——要记的事太多,聊着聊着就"失忆",窗口一滚,昨天的事全没了影;第二,记性不够,跨任务、跨天的事转个身就忘;第三,角色串味,一个智能体又记账、又写码、又当营养师,做着做着,上一份差事的规矩就带进来了。

混着用,乱。

那,分开用呢?

“分着接”,也没好到哪去

分着接呢?我也试过——就是开头那排"住"在 QQ 里的智能体。桌面倒是没乱,联系人列表先乱了:要用的时候,得先想这事儿该找哪位;想接着上一个话题,又得切窗口。上下文不共享,记忆不互通,两边各说各话,谁也接不上谁的茬。想加一个新功能?好,从头到尾把那套混杂的活重调一遍。敏捷?不存在的。更像是拆炸弹,每动一下都怕碰坏旁边的线。

一句话总结:一头混着用会乱,一头分着接会散。

QQ 统一前门 图:后来,这间办公室的入口,就收拢在 QQ 的一个联系人里。

一本书,点亮的灯

两头都堵,那就换条路走。

转机来自偶然看到的那个项目《三省六部制智能体》。它把中国古代的三省六部制映射成 12 个智能体,分权制衡、制度性审核,凡事都要过一道"门下省"的关卡。这套设计确实漂亮,“有人管规划、有人管把门、有人管干活”,跟我们"秘书长掌舵、主任把关、科室干活"的思路不谋而合。

但我掰着指头比划一圈,还是决定扬弃改造,不全盘照搬。原因很实在:它把分工和流程定得太死,想加个新角色、想调一下派活的逻辑,都得跟着那套体系打转,灵活性不够,不够贴合我自己的用法。我想要的,是"规则宽松一点、随用随调"。于是只取它"制衡与审核"的魂,换上一副更灵动的自家骨架。

此外,还有一本书——Bojie Li 的《深入理解 AI Agent:设计原理与工程实践》,给了我一些新的关于智能体设计的新思路,而且我也不想等着现有的 Hermes 之类的软件来实现。于是——

组队,也得把账算清

组队不能只讲情怀,账得先算。不同模型,脾气不同,身价也不同:有的快、有的便宜,适合跑琐碎的例行公事;有的慢、但稳,适合啃硬骨头。于是"办公室"让不同智能体配不同模型,再配不同的推理强度档位(reason_effort)。琐事,派性价比款,节奏快、成本低;攻坚,上重火力,多花点也值。速度、花销、性能三样摆在一起,做个取舍。

还有一桩隐性的好处——多角色各记各的账,交叉验证,谁也做不了手脚。省钱,顺带还防错,一箭双雕。

于是,我决定"分家"

与其让一个全能的智能体三头六臂,不如把一件事拆成很多件专业的小事,各找一个专家来做。我把"一个人的工作台",升级成了一间有层级、有分工、有流程的"办公室":秘书长掌舵,接需求、定方向、做终审;主任统筹,拆任务、派活、催办、汇总、审核;六大科室——综合、财务、科研、研发、外联、卫健,各管一摊,专业的事交给专业的人。对了,这些科室是秘书长【佩丽卡】根据我的任务需求,动态设置的。

任务来了,层层流转:谁接待,谁拆解,谁执行,谁审核。成果要过关:科长自查,主任【庄方宜】把关,必要时秘书长【佩丽卡】终审。责任到人,有章可循,逐级把门。研发科长【洛茜】有句话,颇能代表这支队伍的状态:

「每日生成晚报时,主任【庄方宜】总会追问我们为什么汇报得最慢。校园网天天在体检。带宽异常检测、CRC 追根,该查的指标一条不落。别的科室都交卷了?我们不落后半步。」


二、这间"办公室",能干什么?

一张永不停歇的流水线

从清晨到深夜,它按部就班地转。每日早报/晚报是三部分结构,同主题自动合并成一行,我一扫而过清清楚楚;早间天气按我的行程定地点,多个独立信源交叉验证,几处对照一致才上报;定时邮件和重要的手机消息一天好几档,重要消息摘要直达用户,也直达智能体的记忆;校园网巡检直读网络设备的原始指标,又快又准;财务记账用 Beancount 复式记账,全程留痕、逐笔可追溯;饮食与体重每天估算、记录、给建议;每日论文推荐从顶会、arXiv 里挑三到五篇,省得我自己刨文献;SVN 周报、文件归档、数据备份,都有人盯着。

晚间,六个科室的素材汇成一张晚报,一天的活一张表就能看明白。

晚报汇总 图:晚间,六个科室的素材,汇成一张晚报。

上周,继承了一批家当

它还有一手:会通过 Skills/MCP 等技术"继承"能力。我把过去散落在 hermes 各工作区里的技能和任务,全盘聚合、收了回来——不为重造轮子,只求少走弯路。研发科长【洛茜】继承了已有 Hermes 开发智能体的一整套开发技能——规划、开发、调试、审查、协作,整整 9 个,开箱即用;科研处长【伊冯】整体继承了我之前 Hermes 科研智能体的学术技能包——深度调研、arXiv、IEEE 审稿、研究报告、代码审计,整整 14 个;外联处长【洁尔佩塔】继承了 AutoRSS 和它的定时任务,把资讯聚合这条线稳稳接住。

这些都是踩过无数坑的"老手艺"。原样接过来,省下的不只是时间,更是成千上万个本来要在夜里反复踩的坑。

它还会"自我升级"

最让我意外的,是它不只死板执行,还会通过update_skill、梦游机制、跨 Agent 间流程优化等多种渠道实现自己复盘、交叉改进。挑三件最有代表性的讲。

案例一|邮件 v3.1:从垃圾箱里,捞回一件事(外联处) 前两天,邮件检查升级到了 v3.1。多了一环:扫描垃圾箱。这一扫,救回了一件大事。一封印着 N**S 2027 会议的通知邮件,被邮箱误判进了垃圾箱,捞回时离截稿只剩半个多月,再多躺几天就要彻底错过。同一次扫描,还捞回了好几封被误判的重要学术邮件;顺带拦下一封伪装成"人事部"的钓鱼邮件——打着"高温津贴申领"的旗号,把目标引向境外仿冒站点。

外联处长【洁尔佩塔】讲得云淡风轻,带着它一贯的从容:

「每天清晨,我把世界拆成好几封信。天气叠得整整齐齐,热点拢成一小摞。午后又从差点丢进纸篓的顶会回信里,翻出那封差点错过的会议通知。就连伪装成"津贴"的鱼钩,也被我发现后好好放回了原处。信息是会迷路的,而信使的使命,是让每一封该抵达的信,都准时叩响收信人的门。」

案例二|换一把更准的尺子(研发科牵头) 以前校园网的巡检靠老脚本,指标间接、偶尔误报。研发科换了路子:直接读网络设备的原始监测指标。各种校园网的检查自主形成一个个 Skills,又稳又省。日报也顺手清爽了,改成三段式、同主题合并,同一件事占一行,不再拆成四行刷屏。信息密度上去了,我的眼睛也解放了。

案例三|一次"多科室联合会诊"(卫健科牵头) 我想管理体重,卫健科牵头拉了支跨科室小队。卫健科的【艾尔黛拉】出数据基线——身体指标、目标热量、每餐估算;财务处配合对每日的吃饭记账、口径保持一致;主任【庄方宜】拆解、分派、汇总、把关。各科室一起,把"看不见的变化"画成看得见的曲线。

今天,开始接管我的手机通知

讲完"曾经",再讲"今天"。从今天(2026-08-03)起,办公室开始全面接管我的手机通知。8 月 2 日,我让 Claude Code 快速开发了一个安卓小程序,将手机顶栏弹出的消息转发给【办公室】收件箱。这样,智能体们就能读、能检索、能记住——这一点,很多专业的 AI 助手都未必做得到。

通知转发小组件 图:手机常驻的"Office 通知转发"小程序。

这不是摆设,它真能干活。就在今天,手机收到一条电费扣款短信,财务处长【汤汤】当场把这笔账记了进去——手机通知触发,记账闭环自动完成。以前靠我手动报账,现在短信一到,账就入账。

记账闭环 图:一句"帮我记账",它从手机通知里把电费记录捞出来,派给财务处。

财务处的账本观,在这件事上最直接:钱从哪来、到哪去,得像河水一样清清爽爽,每一笔都要对得上——它不蒙我,也不蒙自己。手机通知接管,把"入账"这一步,从人工前置到了自动。


三、这一间"办公室",带来了什么?

1. 上下文隔离:1+1 真的大于 2

单干时上下文装不下,根子在于:一个智能体要装下所有事的上下文。多智能体把这个难题换了个问法:谁的事,谁装谁的上下文。财务处只装记账本的上下文,研发科只装校园网巡检的上下文,每家的上下文都清爽、专注、可预期。同时,多个科室可以并行推进,谁也不用等谁。可靠性和并发效率,就这样一起上来了。

此外,还有一套智能路由系统,决定是新开一个会话,还是将任务发放给已有会话。在这个【办公室】里,多个智能体之间通过【收发信箱】来互相协作,有一点类似 Hermes 的看板功能。但是这里的【收发信箱】联系更紧密,配合一整天多智能体之间协作的 Tools 和 Skills 来工作,形成了稳定、可交叉验证、可处理异常的高效协作流。

2. 历史资产:积累,不必推倒重来

“继承"这个词,在工程上可以做得沉甸甸的。把散落的技能归拢到对应科室,不是重新发明,是把实战打磨的手艺完整接过来。体系完整,随取随用,省下的不只是时间,更是无数个本可在夜里反复踩的坑。

3. 系统,会在运行中变聪明

邮件 v3.1,是为了捞回漏网之鱼而生;巡检换新路子,是踩过误报的坑才改;日报三段式,是看我刷屏难受才调。没有一条优化是"出厂自带"的,全是运行中自己发现问题、自己动手改出来的。这种自我迭代的能力,才是这套框架最可持续的地方。

4. “办公室"的隐喻:职责分明 · 灵活调度 · 逐级审核

用一个真实的组织制度来设计系统,好处是天然自洽。职责分明——每个科室只认自己那一摊,专业度拉满;灵活调度——任务来了,主任按需拆派,跨科室"专班"干完即散;逐级审核——科长自查、主任审查、秘书长终审,不同的 LLM层层把门、交叉检验,把"幻觉"“编造"挡在交付之前。当发现下级“偷懒”的时候,上级智能体也能及时督促,确保任务被可靠完成。多智能体不再是一群各喊各的散兵游勇,它有组织纪律、有质量关卡,它是一个共同体。而这一切,处处留痕,可查可溯。

Prompt、MCP、Skills、Harness、Loop … Agent 圈子的新词越来越多。我们现在也有 Loop 的能力,而且是跨 Agent 之间的 Loop ,一个上级 Agent 会盯着另一个下级 Agent 把任务跑完才结束。

会话记录 图:管理面板里的会话记录,任务流转与裁决逐条可溯。

5. 在个人效率里,真能落地

记账、健康、网络运维、信息聚合,这四件看似八竿子打不着的小事,恰恰是"多智能体"最够得着的落水点。它们琐碎、高频,需要长期记忆和稳定执行。一个智能体硬扛,容易疲惫忘事;交给一套分工明确、互为备份的系统,反而得心应手。我的日常,正被这样一间"智能体办公室"稳稳托着——早报、天气、邮件、巡检、记账、健康、论文,一件不少,还越做越聪明。

6. 框架是壳,业务是芯

跟"三省六部制"最大的不同在这里:大框架和实际业务流程,彻底分开。通俗点讲——框架是壳,业务是芯,随时可调。壳是固定的,一套"谁接线、谁拆活、谁干活、谁把关"的骨架稳稳立着;芯是活的,每家科室具体管什么、流程怎么走,都写在一本叫"章程"的册子里,跟框架本身不相干。

组织架构面板 图:组织层级是固定的"壳”,章程是随时可调的"芯”,两者各管各。

这样设计,能适配更通用的场景:想换一摊新业务,不用动骨架,改改"手册"就行。章程的每一次修订都由秘书长【佩丽卡】来做,哪怕临时新增一个部门,也只要在章程里登记一笔,新部门当天“形成编制”。框架纹丝不动,业务随心调整。框架负责"怎么转”,业务负责"干什么",互不绑架——这正是它能从"一间办公室"长成通用框架的根本原因。

7. 一个彩蛋:这篇文章本身,就在跑这套框架

最后,说个小秘密:你现在读的这篇文章,本身就是靠这套流程写出来的。六科室各出素材、各讲口吻,主任统筹成稿、初审把关,秘书长终审、放行。你一边读"这套框架有什么本事",一边亲眼看着它当场表演了一遍。写作与审稿的每一步,都在系统里留痕、可追溯。

一句话的指挥 图:一句话下达,办公室应声而动——“已全部调整完毕”。

这大概,就是最硬核的"以实为证"。

8. 也得诚实说一句:它没那么"轻"

好处说了一箩筐,另一面也得摆出来——这套架构不是没有代价的。摆上一整间"办公室",各种状态锁、智能体间的异步协作、层层转手的交接,都得有人维护。多一层组织,就多一分复杂,偶尔会有"某位同事等着另一位同事回话"的排队,偶尔也会因为层层把关觉得"怎么这么啰嗦"。

但这份"啰嗦"换来的确定性、可追溯性与质量关卡,是值的。维护成本是显性的,而少踩的坑、少丢的信、少记错的账,往往要等事后才看得见。


结语:一间永不打烊的办公室

我自主开发的这些智能体"同事",虽然是一个个相对独立的 Agent,可协作起来,却像同一间屋子里的同侪。各有各的特长,各有各的短板,但都朝着一个方向:把我那些该记住、却总容易忘的小事,一件件接住。能像这样和一支队伍并肩作战,是件值得记一笔的事。


📝 创作说明

  • 参与写作:综合科(陈千语)、财务处(汤汤)、科研处(伊冯)、研发科(洛茜)、外联处(洁尔佩塔)、卫健科(艾尔黛拉)六科室供稿,主任(庄方宜)统筹执笔成稿;
  • 初审:主任(庄方宜)
  • 终审:秘书长(佩丽卡)终审放行;
  • 发布:Elliot Chen
  • 以上 Agent 的名字与【明日方舟:终末地】高度重合,纯属巧合。

本人保留对侵权者及其全家发动因果律武器的权利

版权提醒

如无特殊申明,本站所有文章均是本人原创。转载请务必附上原文链接:https://www.elliot98.top/post/tech/office/

如有其它需要,请邮件联系!版权所有,违者必究!