跳到正文
返回作品列表

maxstudio:写给 agent 执行的个人决策手册maxstudio: a decision manual an agent can run

年份
2026
状态
在做
结果
九个 Markdown 文件、零行应用代码,两天里被自己的数据推翻了两条规则

maxstudio 不是软件。它是一个私有仓库,里面九个 Markdown 文件、四条 Claude Code 命令、一个 38 行的 shell 脚本,没有一行应用代码。要解决的问题很具体:业余时间一周只有十来个小时,怎么让这十来个小时花在该花的地方,而不是花在当天最想干的事上。做法是把判断先写下来,再交给一个每次都照着念的 agent。

最花力气的一份文件是数据基线。我把自己小红书账号 36 篇笔记的后台数据一条条拉出来,算每涨一个粉丝要花多少曝光:累计 56.7 万曝光换来 83 个粉丝;同样是爆款,一篇 1.8 万曝光涨了 20 粉,另一篇 26 万曝光只涨 1 粉。所以仓库里的选题规则就只有四种固定写法,外加一份明确的不做清单。最反直觉的是封面点击率:点击率最高的八篇加起来只涨了 4 个粉,而涨粉最多的那篇点击率 9.3%,低于账号中位数。

十一次提交里有两次是专门用来推翻自己的,前后隔了不到一天。一次是封面点击率,原文写着「17–31% 是爆款区间」,拿数据一比方向正好反了,改成「点击率是及格线,不是竞赛项」。另一次是实验命名,原来按顺序编号,编号跟实际跑的顺序对不上,干脆废掉,改用「热身」「补样」「埋雷」这类一看就懂的名字。

仓库当前追的是一个测量课题:多 agent 协作到底什么时候值得。实验平台是我自己写的开源扩展 pi-feishu-im,把几个会写代码的 agent 放进同一个飞书群。怎么摆实验、怎么批量跑、允许 agent 改哪些东西,都写死了。第一组对照就把最初的假设打了回来:同一个任务,几个 agent 一起干比一个 agent 单干还慢,结果也没更好。

它给自己定的那几件例行公事,到现在基本没动起来。周复盘目录是空的,一次都没写过。每天早上 7:38 的热点扫描注册进了 launchd,也确实触发过,但脚本一直没被加上执行权限——这件事就写在交接文档的待办里,至今没做——8 月 12 日第一次触发之后一次都没成功,两个日志文件零字节,选题库里的热点收件箱还是空的。唯一一篇写完的稿子还标着「待发布」。那个测量课题最新的结论已经写进两个文件、加起来 163 行,从 8 月 14 日躺到现在没提交。

决策那一层是真的,我也确实在用;自动化那一层是个还没通电的壳子。仓库自己的第六条铁律早就说了:维护这个系统本身不算工作进展,产出只有三种——代码进了仓库、内容发了出去、和一个真人说上了话。