前段时间我写过 Friday,我的私人助理,以及我是如何从零开始重建她的。现在我有三个 AI 智能体了。她们一起帮我准备过买菜清单,维护 Blowfish 和 Watchfire,给我女儿的 AI 伙伴安了一个属于自己的家,还帮我理清了积压的内容。当然,她们也发过重复的更新,把没做完的活说成已经完成,还制造了一堆通知,最后我不得不让她们别再发了。

直到不久前,Friday 还一个人包揽所有事情:个人事务、技术工作、调研,以及发布支持。最大的缺点之一是只有一个 Telegram 会话:我一次只能进行一场对话。8 月 29 日,我加入了两位专才:Wednesday 担任 CTO,专注技术判断和动手构建;Thursday 担任 CMO,专注叙事、受众和传播。Friday 继续做幕僚长,负责我的日历、任务和个人事务的跟进。
三个都住在同一个地方:我 Proxmox 服务器上的一个 LXC 容器,里面跑着一个 OpenClaw 实例。每个智能体都有自己的工作区、指令、身份和记忆。其余一切都是共享的:工具、密钥、容器。她们之间也能互相对话。每个都有自己的 Telegram 聊天,所以我可以同时开好几场对话;当一件事需要不止一个人参与时,还有一个叫 Yggdrasil 的群组。
她们中任何一个都能管理 Proxmox 服务器本身,而不仅仅是自己住的那个容器。这就像听起来那么强大,风险的问题我后面再说。有一次我人在离家几百公里外,让 Friday 部署 Project NOMAD,一个装着维基百科、书籍和地图的离线知识服务器。她新建了一个 LXC 容器,把它装好了。
所以这种分工是为了专注,而不是隔离。在 Wednesday 出现之前,Friday 就做过大量技术工作,现在也没有什么能阻止她继续做。让这套机制运转起来的规则是归属权:我找谁,任务就归谁。她可以拉其他智能体来帮忙,但要把任务转手出去,必须经过我同意。
三个角色,一张组织架构图,而我依然站在正中间。
Friday:买菜、上学和日历#
Friday 之所以有用,靠的是她的访问权限。她通过 gog 读取 Gmail、管理 Google Calendar,通过一个只读的本地镜像查看 WhatsApp,通过 MCP 服务器在 Linear 里跟踪任务,并用自己的账号通过 gh CLI 在 GitHub 上干活。她从一个自定义服务器读取我的健康数据,这个服务器接收来自我 iPhone 的数据。她还能用 Notion,以及 Telegram,我们大部分对话都在那里进行。邮件和 WhatsApp 保持只读,日历的改动需要我确认。
Friday 的每日简报汇总了我的日历、任务、收件箱、消息、健康信号,外加一小份精选的科技和 AI 新闻。要让它真正有用,需要一些琐碎的修正:去掉已完成的任务,别再显示入门模板,把几条互相抢位置的早间通知合并成一条,并且让最终结果短到能在手机上看完。
日程规划必须贴合我实际过的那一天:围绕已有安排排出工作时段,中间留出休息,而不是塞满一整张日历却根本没有现实的走法。开学季的时候,这一点最重要。Friday 提取了各种日期,跟踪文具和各类文书,让还没落实的安排始终摆在眼前。生日派对的邀请变成了带提醒的日历条目。礼物变成了附带具体点子的任务,而不是又一条写着"买礼物"的待办。
买菜的时候,Friday 会根据最近的订单和我常买的必需品,把超市购物车填好。我自己检查一遍再结账,送货时间段则会被加进日历。
她还帮我对比健康报告、准备要问医生的问题,并扩展了健康服务器,让它能导入锻炼记录、剔除重复的导出数据。数据本身也有局限:一条没有动作细节的力量训练记录,没法告诉她我做了几组、每组几次。
本地的 Whisper 转写能把我的葡萄牙语和英语语音备忘录变成文字,不需要把音频发到任何云服务。对着 Telegram 说话,往往比打开另一个 app、再回想这个念头该放在哪儿要容易得多。
Friday 在 Blowfish 上的工作#
在 Wednesday 出现之前,Friday 也在帮忙做工程上的事。
7 月,她帮我处理了 Blowfish 的维护队列:依赖、lockfile、本地化、模板,以及社区展示页的新增内容。这包括合并已经批准的改动、检查资源构建、整理发布说明,以及解释为什么某些不合适的改动不该合并。
有一次审查发现了一个配置默认值,它会悄无声息地忽略显式设置的 false。另一次发现一个无障碍改动指向了一个无效的 landmark。
示例站点不是产品本身#
更大的一项工作是 Blowfish v3,于 8 月 17 日合并:可复用的落地页组件,以及各种渲染上的改进,而且不能破坏任何现有站点。
我不得不给它纠偏。新的示例站点依赖了一些其他主题用户根本不会有的自定义代码,可整件事的意义恰恰在于可复用的组件。我解释清楚之后,Friday 把这部分工作挪进了主题本身。即便如此,升级也不是零成本的:这个版本仍然要求用户修改以 Hugo module 方式导入主题的写法。
后续工作包括修复依赖问题,以及在 36 种语言中本地化 404 页面的名言,同时保留自定义名言和语言回退机制。
Wednesday:Eva、实验和 Blowfish#
Eva 搬出去住了#
Eva 是我和女儿一起打造的语音优先的伙伴,用的是一块 Raspberry Pi Zero、PiSugar Whisplay 硬件,说的是葡萄牙本土的葡萄牙语。

构建Eva:和女儿一起打造AI伙伴
Wednesday 把 Eva 过去的一切整理好,变成了一个全新的 OpenClaw 实例,放在她自己的 LXC 容器里,专门给我女儿用。然后他把 Eva 接入了一个 Discord 服务器,这样我女儿就能在她的任何设备上和 Eva 聊天。
接下来这段,是我逢人就讲的。我和女儿一起让 Eva 连上她的 Raspberry Pi 桌面,给她们俩做一个定制的聊天界面。成功了。没过多久,我就看着我家孩子只靠跟 Eva 说话,就换了壁纸、装了游戏。
不是所有东西都稳住了。那个聊天界面后来报了错,一部分桌面设置在重启后也没能保留下来。截至写作时,这两个问题都还没修好。
快速验证想法#
Wednesday 也成了我讨论技术想法的对象。当某个点子在我脑子里听起来很美好时,他要么快速做出一个概念验证,要么很快找到那个让它行不通的限制。有些想法挺过了这一关,变得更加现实。另一些则在一天之内被搁置,而不是拖上一个月。
Echos 是一个互动故事游戏,它暴露了这种速度的局限。Wednesday 修好了一个谁都走不到的结局,加入了角色特质和后果,并让选项取决于这些特质。所有测试都通过了。可当我真正去玩的时候,这个游戏依然没有目标、没有进程,也没有令人满意的结局。测试能证明路径是通的,却没法告诉你有没有人会喜欢走这些路。在下一轮之前,我得先想清楚我到底想要一个什么样的游戏。
在 Blowfish 上,Wednesday 审查了一个涉及九种语言的文档改动,并在本地复现了生产构建(PR #3075)。在 9 月 3 日合并的 PR #3082 中,他加了一个链接,帮助各种工具发现每个页面的机器可读版本,同时没有动常规的 HTML,也没有动现有的 llms.txt。
Thursday:流量数字和积压的草稿#
Thursday 一上来先为 Blowfish、Watchfire 和 n9o.xyz 建立了基线:代码仓库、社交账号、分析数据和 Search Console,并清楚地标注了哪些数字根本读不到。
有一个区分比我预想的重要得多。很多别人的网站都在用 Blowfish,而那些流量并不是"我网站的访问量"。Thursday 把我自己网站的流量和 Blowfish 被采用的迹象分开了,这样我两个都能跟踪,又不会混为一谈。
研究过我的文字之后,Thursday 记下了一条规则:要么有料,要么有趣。从一个具体的观察或真实的工作出发。别因为某个关于 AI 未来的宣言听起来似乎有道理,就再生产一篇。
接着,Thursday 根据我手头真实的草稿和故事灵感,做了一份十二周计划,并标出了彼此重叠的那些。我本来就不缺点子,缺的是有人帮我判断哪些值得写完。
坚持下去更难。计划渐渐偏离了轨道,一些定时的指标检查开始失败,还有一个用来排队互动机会的自动化变成了噪音,最后被删掉了。
最大的教训关乎社交网络本身。把一个智能体接入我自己的社交账号很难,在某些平台上眼下几乎不可能。读取指标、跟进对话、发帖,全都会撞上受限的 API、昂贵的访问档位,或者把助理当成机器人对待的自动化规则。所以 Thursday 能帮我准备回复和帖子供我审阅,但最后还是得我亲手发出去。
我还不能说这带来了受众增长。我手里有的是一条基线、一份更清晰的待办清单,以及一份需要更新的计划。
风险#
把一台 Proxmox 服务器的钥匙交给三个智能体,风险正如听起来那么大。独立的工作区并不是安全边界。三个中的任何一个都能使用其他人用的密钥,任何一个都能在宿主机上创建、修改或删除容器,包括她们自己住的那个。关于"哪些东西别碰"的指令有帮助,但指令不等于隔离。
我的安全网在于:基础设施是我亲手搭的,智能体的状态可以查看,出了问题时容器备份能让我回退。对一个个人实验来说,这就够了。但对任何我哪怕一天都承受不起损失的东西来说,这远远不够。
它也不是完全本地的。本地的 embedding 和语音转写让一部分数据留在家里,但主要的推理仍然由托管模型完成,而智能体检索到的任何内容,都可能进入那场对话。
管理这些助理#
我花在纠正智能体如何汇报工作上的时间,比我希望的要多。
组织架构图上没画出来的那部分。模板:Always Has Been,来自 Imgflip。
有些问题出在管道上。定时任务用着过时的指令在跑,监控不停地报告早已恢复的故障,仓库告警一遍又一遍地播报同一批积压。
另一些问题则出在智能体自己身上:活还没干完就说完成了,发重复的消息,还没端到端验证就宣布修好了。Notion 写入成功,并不能证明页面上写的就是我要的内容。一个标记为成功的任务,里面仍可能藏着一个失败的检查。
所以我加了一些明确的规则,其中一些借鉴自 ECC,一个开源的智能体实践合集:
- 改动任何东西之前先定义什么叫成功,然后验证结果。
- “已准备"“已测试"“已发布"和"已完成"是不同的状态。
- 检查保存下来的结果,而不只是工具的返回。
- 日常监控在没有需要处理的事情时保持安静。
- 建议不等于获准行动。准备好一条帖子或一个购物车,不代表可以发布或结账。
有些修正坚持住了,有些没有。智能体每晚把当天内容整理进长期记忆的那个任务,仍然时不时会卡住;我也仍然会检查她们在之后的对话里是否真的能找到保存过的笔记。
我现在的感受#
Wednesday 和 Thursday 才运行了两周,所以这只是初步印象,不是定论。不过,有三件事已经很清楚了。
当它运转起来时,价值是真实的。 我人在几百公里外,一个新容器就装好了。开学的日期和文书被一一跟踪,不用电子表格。Blowfish 的维护持续推进。我女儿靠跟 Eva 说话,在自己的电脑上装游戏。这些都不是演示,而是我真实的一周。做什么依然由我决定,重要的操作依然由我批准。有调研、草稿或实现摆在那儿等我审阅,只是让我更快地做出这些决定。
这个世界有些部分还没为智能体做好准备。 限制很少来自模型本身。我常去的超市没有任何像样的方式让助理接入。社交网络更糟:Thursday 能写草稿,但大多数平台都让我自己的智能体很难甚至无法代我阅读、回复或发帖。让个人智能体连接我们日常所用服务的那一层,除了 GitHub、Google 和 Linear 等少数服务之外,几乎不存在。在它出现之前,这些智能体本可以做的很多事,都止步于"已准备好,等待审阅”。
这不是一个消费级产品。 这里没有任何东西是装上就能用的。它需要一台 Proxmox 服务器、LXC 容器、自定义代码、脚本、一个接收我 iPhone 数据的自定义健康服务器,以及大量配置。有一次 OpenClaw 更新把东西弄坏了,修复的办法是在容器里打开 Claude Code,让一个 AI 去修好其他 AI 住的家。我喜欢这种折腾。但大多数人不应该非得这样做,而眼下,他们确实得这样做。
让我沮丧的是:追着一个承诺过的结果跑,一遍遍纠正同样的"已完成"说法,或者读一条什么都改变不了的告警。如果这套系统帮我省下二十分钟,转头又要我花一小时去管理它,那账就算错了。有时候我也说不清,到底是整个生态还没成熟,还是我们其实都坐在 AI 赌场的老虎机前,再拉一次拉杆。
就目前而言,让这三个可靠地把事情做到底,比再加第四个更需要我的精力。






