前言:你不写代码,你写说明书
先说清楚这本书是给谁的。
你每天的活里有一部分是重复的:整理文件、汇总表格、把会议录音听完写纪要、把几十条评论一条条看完分类、 每周同一个模板的周报。这些活不难,但费时间,而且做一百遍还是要自己做。
你不写代码。你听说过 agent,也许试过网页版的聊天机器人,它能帮你写一段话,但它不能碰你电脑里的文件, 不能打开你的浏览器,做完一次下次还得从头说。
这本书讲的是另一种 agent:一个装在你自己电脑上的 agent。它能读写你的文件,能开你的浏览器, 能记住你的偏好,能每天早上自己跑,能在微信里接活。它叫 octo,一个安装包,双击装,选一个模型, 开始干活。
你要学的只有一样
让 agent 干活,你不需要学编程。你要学的是把活说清楚。
想一想你给新来的同事交代一个活怎么说:要处理的文件在哪、想要什么结果、哪些别碰、 做到什么程度算完、拿不准的时候来问我。你对 agent 说的就是这些。说清楚了,它干得比你快; 说不清楚,它干得比你想的还快,方向还是错的。
有些活你会反复交代。这时候你把交代的话写成一个文件,放在它看得到的地方,下次一句话就能触发。 这个文件叫说明书。它长得像一篇有格式的备忘录,不是代码。这本书里你会写好几份, 它们就是你的“编程“。
所以这本书的立论是一句话:你不写代码,你写的是给 agent 看的说明书。
先判断这活配不配交给它
不是所有活都该交给 agent。拿到一个活,先问三个问题:
一句话能说完,它算一遍就出结果的活。 翻译一段话、给一段文字起标题、把一封邮件改得客气一点。 这种活网页版聊天机器人就够了,不需要这本书。
步骤固定、每次一样的活。 把这个文件夹按月份归档;把这张表按部门拆成五张;把录音转成文字再列待办。 步骤你自己都写得出来,只是不想每次都做。这是这本书大部分章节在讲的活,agent 干这类活最稳。
要它自己拿主意的活。 把这两百条评论看一遍,哪些是真想买的、哪些是来吵架的、哪些该回、怎么回。 每一条它都要判断,判断完还要决定下一步查什么。这类活 agent 也能干,但你要给它更多的边界, 也要在关键的地方停下来让你看一眼。
第二类和第三类是这本书的范围。第一类你已经会了。
这本书怎么安排
Part 0 两章:装好它,学会跟它说话。
Part 1 十五章,每章一个真实的活。功能不单独讲,在活里需要的时候才出现。整理文件夹的时候你会遇到 权限确认,出 Excel 的时候你会第一次见到说明书,让它每天早上自己跑的时候你会碰到定时任务。 读到哪章就做哪章,做完手上留下一个能用的成果。
Part 2 六个案例,每个从头到尾:输入是真文件,输出是真交付物,有截图,有翻车的地方, 有用了多长时间。第一个案例是一个做小红书的人的一天。
附录是查阅用的:常用的原话模板、我想做什么该用什么、你是什么岗位从哪个活开始、功能速查。
先说好的几点
每一章的输出都是真跑出来的。 截图没有摆拍,翻车没有省略。你的结果会跟书里不一样, 但差不远。
它会问你,也会停下来。 这不是缺陷。它碰到要动文件、要发出去、要拿不准的事情时停下来等你点头, 是它最重要的设计。书里会反复教你什么时候该让它问,什么时候可以让它放手。
octo 是开源的,也是我参与的项目。 这本书同时是它的使用手册和推广。我尽量只写它能做到的, 做不到和做得不好的地方如实写。
这套书一共三本
《笨办法学 Agent》系列现在有三本,各自独立,不要求先后顺序:
- 《笨办法学 Agent · 亲手打造一个 harness》:不用任何框架,32 个练习亲手写出一个 agent harness 的每一层,目的是看懂——给想看懂原理、愿意写代码的人。
- 《笨办法学 Agent · 用 LangGraph 上线》:用 LangGraph 把真实场景的 agent 做出来、 放到线上给人用,目的是上线——给要交付真实产品的人。
- 《让 agent 替你干活 · 不写代码,用 octo 把活干完》(这一本):不写一行代码, 用装在自己电脑上的 octo 把日常的活干完——给不写代码的打工人。
三本共享同一句话:agent 没有秘密架构,会不会用,看你会不会把活/场景/工具边界说清楚。 你只读这一本完全够;如果哪天你好奇它里面是怎么转的,第一本在等你。
好了,去装它。