我给这个公众号起名叫: 教造不焦躁。
“教”,是因为我是个老师。 “造”,是因为下课以后总忍不住折腾点东西:软件、游戏、网站、建模……脑子里冒出来一个东西,就很想把它真的做出来。
至于最后三个字—— 不焦躁。 现在看来,或许更像一个奋斗目标。
尤其是在我最近干了一件,怎么说呢,“中年男人掌握新技术以后迅速膨胀,直至爆炸”的事情之后。
事情是这么开始的。 我给自己办了家公司。
没有租金,没有五险一金,不用团建,也不会有人星期五下午突然发消息: “老师……额,不,老板,我身体有点不舒服。”
理论上,我每天晚上睡觉以前只需要说一句: 继续。
然后云端几个员工一边查资料、翻 PPT、读论文、写教案、做幻灯片;另一边读代码、改程序、审查 Bug、跑 Godot、开 Blender 建模。
一个做完,另一个接上。 有人负责施工,有人负责检查。 第二天我起床,喝口水,看成果。
这大概是一个已经被工资、房贷和高三教学充分教育过的中年人,能够想象出的资本主义终极形态: 老板睡觉,员工通宵,老板起床,通宵的员工还要殷勤问好。
这个美好的东西,是 OpenAI 的 dots。单个代理叫 dot,复数是 dots。下文用 Dot,指我自己的这个代理。 如果这套东西真的能持续运转,那场面会非常离谱: 我白天教书。 晚上提需求。 AI 连夜施工。 第二天早上验收。
人类终于找到了可以无限压榨,却不会让自己产生道德谴责的员工。
当然,如果你熟悉灾难片就会知道: 美好蓝图到这里,就该出事了。
序章 / 真正上头的地方
先说清楚:它真的能干活
如果 Dot 从头到尾都不好用,这篇文章就没什么可写的。 我不会为了一个纯废物,折腾掉一个宝贵的国庆节。
最开始,它给我的刺激非常直接。 我扔进去 Blender 建模任务,真的出了东西;我让它做游戏,大富翁从最开始“能运行但有点无聊”,一点点加进技能、随机事件、四季、股票、建筑、音乐,最后真的有一个版本,孩子喜欢,我也喜欢。
我的课表 App「课余」①也开始放进独立分支整理代码;校园建模逐渐出现建筑和场景。
这些不是 PPT。 是真的有东西出来。


这才是 Dot 最容易让人上头的地方。 你只要提要求,脑子里的东西就开始长出来。 于是我组建了一个工作室?
再过一天,我连名字都取好了。 小爱负责总调度,小鱼做 App,小富做大富翁,小嘉做校园…… 我甚至真情实感地问过一句:
“你不会骗我吧,我可是投入感情了的。”
现在回头看,这句话具有非常浓厚的恐怖片台词气质。

到这里,我已经不觉得自己在用 AI 了。 我觉得自己在创业。
很快,现实告诉我: 你确实可以当老板。 但在当老板之前—— 你可能得先当一阵子班主任。
01 / 检查在运行,工作呢?
第一坑:自动化最稳定的功能,是自动告诉你它没干活
我的理想很简单。 A 做完,接 B。 B 卡住,那就先做不受影响的 C。 我睡觉,不代表全公司陪我睡觉。 而且这些要求,我确实写进自动任务了。
于是10月4日早上,我很放心地查了一眼自己的云端公司。 正在执行:
巡检在线 / 执行离线
0人。
依据当时记录排版 · 非平台截图
我第一反应还非常传统: 是不是我这个产品经理没说清楚? 结果往回一查,更精彩。
要求有。 “完成后在派发”,有。 “受阻以后继续其他已经授权的任务”,也有。 只是——
都!没!执!行!
当时核对的结果很直接:夜里主要在反复检查状态,但没有把“检查到没人”继续落实成新的实际派发。
动了,它确实动了。 自动任务也真的运行了。 它只是自动运行到了: “让我看看现在有没有人在干活。”
一看。 没有。 然后结束。
像每个中年男人的减肥计划: 研究碳水,研究心率,研究有氧区间,收藏三个视频。 第二天继续胖。
后来我给它增加了定时唤醒和回执。 它会准时醒。 会告诉我: “收到。” 我过一会儿再回来: 还在原地。
到这里我终于理解了一件非常朴素的事。 无论学生、AI,还是某些在家里说“马上”的中年男性—— “收到”不是动词。
真正有用的修改,是后来把标准换了。 别告诉我你准备继续。 告诉我: 谁已经接到了什么,现在到底有没有开始。
于是“继续”这个词,终于从一种态度,变成了一个动作。后来也真的出现了上一项结束后继续派修复、独审和后续工作的接续链。 所以第一个坑其实很简单: AI Agent 会规划下一步,不代表下一步真的发生了。
02 / 先谈感情,再查身份。
第二坑:我网恋半天王一博,最后发现他是王宝强
接下来就是我这周的崩溃瞬间了。 前面说了,我已经给这群伙计起名字了。 人一旦开始给机器起名字,理智一般就已经下降了一点。
我开始会说: “小鹏继续做车。” 这里的小鹏,其实负责做的是小米澎程②。 为什么给澎程取名叫小鹏? 没有为什么。 人到了一定年纪以后,偶尔也应该享受一点跨品牌管理的自由。
后来车一直做不好。 我开始把资源往这条线上堆。 而我脑子里一直有一个非常重要的前提:
因为Dot是由Astra驱动的,所以一定所有项目都完成得很好?
别人的项目:


而我的!!!!

为什么 Astra 做成这样? 是不是资料不够? 是不是几个代理配合得不好? 是不是建模方法有问题? 是不是参考图不够? 甚至有那么一会儿我开始怀疑: 是不是澎程本人长得就比较抽象。
直到某一版出来,我很难继续保持一个产品经理应有的体面。 它不能说完全不像车。 但如果放到“拼少少9块9包邮车模”专区里, 我大概还是会申请退款。
在无数次的进行修正之后,我终于问了一句: 等一下,为什么别人用Astra做出来的建模就那么精美,而你做出来的却如此凤姐?
答案出来了。
依据当时记录排版 · 非平台截图
…… 我当时确实连脏话都蹦出来了。 不是因为 Luna 有什么原罪。Luna 是 OpenAI 模型家族里主打速度和低成本的轻量模型。怎么说呢,也不能说她差,毕竟价格是真的便宜;当然也不能说她好,不然,你觉得为什么她会这么便宜。
真正让我崩溃的是: 我们建立的所有信任,都崩塌。
那种感觉,不是“学生考差了”。 而是你拿着一张成绩单,熬夜写了三页学情分析: 基础题为什么掉分? 尖子生为什么退步? 最近教学方法是不是出了问题?
最后教务处走进来: 老师,你这个分析写得挺认真。 就是这套不是你们班的卷子。
…… 那一瞬间,你甚至不是生气。 你只是很想问: 那我们前面到底在忙什么?
你以为在执行的模型,不一定就是实际执行的模型。
Dot 是总调度,不等于它下面每一个执行任务都会天然继承你脑子里的配置。 任务叫什么名字,也不代表是谁做的。 “小鹏”“小富”,属于我的情感生活。 模型、执行位置、真实任务状态,才是劳动合同。
后来我干脆要求汇报固定写: 任务 / 实际模型 / 子代理数量。 因为我已经不太想继续和昵称谈恋爱了。
换成 Astra 后,车辆确实出现了我认可的局部改善,所以我也没有因为前面翻车就把所有东西推倒。我让它继续修,还补了参数采集。

这反而证明了一件事: 模型不是玄学,但模型配置必须透明。
03 / 这次,轮到工程失联。
第三坑:AI还在,工程没了
前两个坑让我烦。 这个坑第一次让我有点怕。
10月3日晚,我突然发现: 多个近期工作目录访问不了了。 工具版本也和前面不太一样。 部分工程后来能从归档里恢复。 有些阶段—— 只剩图片。 可编辑模型、生成脚本,没有完整找到。
而且我当时说了一句话: “而且这已经是我第二次遇到这样的情况了。”
从用户体感看,这真的很像一次崩溃式重置。 就像我时隔一个月,又回到了高三,头顶的红毛都还来不及毁尸灭迹,又回到熟悉十五班,却发现无人等待。
当然,严谨地说: 我不知道后台究竟发生了什么。 现有记录只能支持“工作环境明显变化、部分近期目录无法访问”;我不能据此说是谁永久删除了文件。
但对一个正在干活的人来说,机制叫什么已经没那么重要了。 后果是一样的: 你本来准备用今天继续开发。 今天改成了—— 考古。 甚至盗墓的都比你挖得多。
更可怕的是视觉任务。 一张 Blender 渲染图还在。 你甚至可以拿去发朋友圈。 看起来岁月静好。 但 .blend 没了。 于是你拥有了一张——
非常漂亮的遗照。

从这一次开始,我才真正理解“保存”这个词。 “生成过文件” 和 “文件还能取回来” 不是一回事。
“压缩成功” 和 “我真的解压并重新打开过” 也不是一回事。
截图负责证明它活过。 源件负责证明它还能活。
我以前对 GitHub 的理解非常朴素: 程序员放代码的地方。 这几天以后,我开始理解,为什么版本管理这种听起来一点都不性感的事情,可以活这么多年。
代码该进仓库,就进仓库。 重要阶段留分支、版本和回退点。 需要合并的东西走清楚的合并流程。 大型 Blender 文件、媒体素材这些不适合直接粗暴塞进普通 Git 仓库的,也至少需要脱离临时工作区的阶段归档。
然后—— 真的取回来一次。 真的解压。 真的打开。
方法 / 我和 AI 都得补课
最后,我到底怎么“驯服”它的?
写到这里,我也得替 Dot 说一句公道话。 有些坑,是它挖的。 还有些坑—— 是我拿着铲子在旁边积极配合。
我本来是老师。 一开始拿ai备课,准备资料素材。 孩子们毕业了,我像每一个孤寡老人一样,去寻找夕阳红,然后就神奇的发现,ai还能做产品。
后来开始做产品。 再后来写 App、做游戏、碰 Blender。 而这几天,我才第一次真正开始理解 GitHub、分支、PR、代码审查、版本保存、多代理协作……
我的专业状态大概可以概括为: 产品想法很多,工程常识正在加载。
以前我会有一种很自然的幻想: 既然 AI 已经这么聪明了, 那仓库怎么管、版本怎么留、什么东西该合并、谁负责审查、成果怎么恢复—— 它应该顺手替我解决吧?
后来发现不行。 AI 的确可以把很多专业工作的门槛压得非常低。 但它不会顺便—— 取消专业本身。
不会 Git,我就很难真正理解为什么分支和版本重要。 不知道 PR 是干什么的,我就很容易把“有人改完了”和“这个修改已经安全进入主版本”当成一回事。
不懂资产管理,我就可能把“还有一张图”误认为“工程还在”。 不会项目管理,就容易产生一种非常朴素的数学幻觉: 七个代理在线, 等于七倍效率。 事实证明,也可能等于—— 七个人同时在改同一扇门。
所以这四天真正被“驯服”的,其实不只有 Dot。 还有我。
最后形成的规则,没有任何一条像什么神级提示词。 反而都非常像一个现实中的班主任终于受够以后,写在黑板上的班规:
第一,一个班最好只有一个班主任。只留一个总调度入口,不要五套规则同时指挥一群人。
第二,做完一道题,不代表今天的学习结束。一项任务结束,就要判断下一步:修复、独审、保存,还是回到原目标继续拆下一项。
第三,可以谈感情,但考试还是得看准考证。“小爱”“小鹏”都可以继续叫,但实际模型、执行位置和任务状态必须能核。
第四,班规和今天的作业不要写在同一张纸上。长期协作规则和具体项目进度分开,否则圣旨越写越长,最后谁也不读。
第五,掌握学情不能只听一句“我会了”。成果必须能看到、能取回、能重新打开。
第六,闹钟不只负责叫醒,还要提醒它翻班规。
我给它布置了定时自动任务。每次触发,都要重新阅读中央 AGENTS 和当前项目的 AGENTS,把最新目标、上下文约束、暂停范围和项目进度补回本轮上下文,再决定下一步。
中央 AGENTS 管“全班的规矩”,项目 AGENTS 管“这门课的作业”。读不到就报告,读完就按最新约定接任务,不能只回一句“收到”。
闹钟把它叫醒,班规让它别一醒就自由发挥。

到了下午,事情终于开始出现我最开始想象的样子。 官网、大富翁有了我能直接打开的候选,我回来以后实际验收通过;车辆从后灯、后杠接着做到轮面,W4接到W5,图片和可恢复源件都留下了。

10月4号16:35,我说了一句: “我感觉这一次完成得非常好,所有的任务一直在推进,没有停止。”
这句话和上午骂人的,也是同一个人说的。 非常稳定。 这大概就是我四天使用 Dot 最完整的评价。
它没有突然变聪明。 Astra 也不是换上以后,所有问题当场消失。 真正发生变化的是: 规则终于从“写在那里”,变成了“真的发生”。
当然,我依然不能证明它从此可以一个月无人值守。 车辆也远没有做到最终一比一。 有些路线照样失败了。 但至少那一刻,我第一次觉得: 我不是在监督一群 AI 写周报。 它们开始真的接着干活了。
文中项目 / 不另起一篇说明
文中提到的几个东西
①「课余」我自己正在做的一款本地课表 App,主要是今日/周课表、课程提醒、课后记录这些功能,目前仍在测试阶段。 严格来说,这里甚至还谈不上广告——毕竟正式版还没上。
② 澎程 N90 Max这次用来测试多个云端任务协同 Blender 建模的车辆项目。文中的车辆图片都是阶段成果,最终整车形似并没有因此自动验收通过。
至于大富翁、校园、官网,也都是我这几天拿来实际折腾 Dot 的项目。它们在文章里不是为了证明我项目很多,主要负责证明: 那些坑,我是真的一个个踩过。
尾声 / 还想继续造
四天下来,我对 Dot 最大的认识
以前我觉得 Agent 最重要的能力是: 它能做多少。 现在我更关心另外几件事情。
它做的,是不是你以为的那件事。 真正执行的,是不是你以为的那个模型。 上一项结束以后,它会不会自己接下一项。 哪怕云端突然抽风, 成果还能不能活下来。
因为 AI 时代最危险的错觉,不是: 它什么都不会。 而是:
它看起来一直在工作。
这句话对人也适用。 所以,这并不是一篇劝退 Dot 的文章。 避开所有坑之后,他依然很好。
只是这几天以后,我大概不会再因为一句“正在执行”、一张漂亮的进度表,或者一句“已经完成”,就提前开香槟了。
我还是那个下课以后喜欢折腾东西的人。 软件还会继续做。 游戏还会继续改。 模型也还会继续造。 我只希望,以后白天当完一天老师,晚上回家以后,真的可以让我当一会儿老板。 而不是再接手七个学生。
至于下一次 AI 一本正经地告诉我: “已经完成。” 我大概会先问一句:
“东西呢?”

教造不焦躁
东西还想继续造,漂亮话不能直接要。
教造不焦躁。至于焦躁的部分,这几天我已经先体验过了。
