这个网站连续十九天每天发布,自己部署自己,把自己翻译成十八种语言,还测量自己的流量。这些文章我没有写过一篇。我只批准过一次流水线,然后读台账。这就是现在的全部工作——有意思的并不是它能跑起来,而是它到底在哪里崩。
机器不需要我惊艳,只需要我联系得上。
幕后班底
跑这个网站的东西毫不花哨。没有微调,没有向量数据库,没有多智能体表演。一台桌面机上的三个定时任务:
- 每日写手——从自动补全里挖真实的搜索用语,对照一本「什么已经奏效」的台账,按严格契约写作(frontmatter 模式、字数、真的能跑的代码),然后部署。
- 运维层——走 CI 和镜像仓库的 GitOps 拉取式部署,每篇文章一个 IndexNow ping,跨站分发,外加覆盖 18 个 locale 的翻译流程。
- 观察者——招聘板和创始人论坛,按画像匹配,招聘信息发出后几小时内推送到手机。
Cron 加书面契约。契约才是产品;模型只是每个月续一次的理发。
看数据,不看感觉
统计是 9 月 17 日上线的,所以这是第一批真实数字——原样引自我们 self-hosted 的统计工具 Rybbit:
$ jrybbit overview --days 7
metric value
-------------- -----
visitors 146
sessions 188
pageviews 288
bounce_rate 79.8%
visit_duration 2m15s 从第一篇讲本地跑模型的文章算起,十九天十九篇,零个漏掉的档期,零次回滚。Google Search Console 还压着 25 个页面在「Discovered – currently not indexed」状态——年轻域名的正常队列,也是一份很有用的谦卑收据:Agent 控制的是发布,不是排名。
反馈回路还在复利。昨天那篇讲 RAM 的文章——本站第一篇非教程——24 小时拿下 69 个浏览,而教程的滚动中位数是 13。台账记下了它,下一篇写什么也由台账决定。不需要任何委员会。
诚实的台账:真正坏掉的东西
十九天里四次故障,全都是我的锅,没有一次是模型的:
- 盯错了部署。 第十一天,Agent 盯的是最新的 CI run,而不是它自己刚推的那个,为别人 commit 的绿色对勾庆祝了一场,结果什么也没发出去。修复无聊得丢人:按你推的 commit SHA 选 run。把规则写下来,不然每个月重新学一遍。
- 一个只会数零的目标。「读完博客」转化盯的是
**/blog/*——一颗星、一个路径段——于是所有嵌套的文章路径都无声漏掉了。修复后回填数据,挖出 94 个一直在发生却没人测到的真实转化。网站是好的,撒谎的是记分牌。 - 把自己图片吃掉的构建。 静态构建脚本每次运行都清空图片目录,于是前两篇文章的 banner 在生产环境 404,本地却完美无缺。把「删除」删掉,资源按 locale 保留。
- 翻译漂移是政策风险。 十八个 locale 会把任何偷懒放大十八倍,所以规则变得机械化:英文版发什么,同一轮所有 locale 就发什么;linter 让缺口变成「发不出去」,而不是「仅供参考」。
Agent 栈是一份和编译器签的契约。你少写的每条规则都是未来的事故,而且事故会准时到货。
注意这四次的共同点:模型精确执行了指令。每次故障都是一个「自以为讲清楚了」的人犯下的规格错误。
没人宣传的那部分
默认草稿是承重墙。每封外发邮件、每条评论、每次营销活动,都先渲染成草稿,直到人类放行一个字。十九天零尴尬发送——不是因为模型写得小心,而是流水线根本不在乎它听起来多自信。没有发送按钮的自信,只是散文。
第二件没被宣传的事:Agent 遵守法律比人更在行。「全部渲染,只动 opacity」终结了几个月微调都没解决的布局偏移问题——因为 Agent 把法律当法律,而不是 deadline 之下可以再商量的建议。
该你了——以及下一期通报
先问系列问题,毕竟这是第 1 期:下一期一线笔记该写什么? 候选在板凳上:作为信任问题的翻译流水线、统计到底改变了哪些选题,或者职位监控栈。你开口,第 2 期自己就写出来——字面意义上。
再问个大问题:如果一台机器每天发布你的作品,而台账说它跑赢了你的中位数,你存在的意义到底是什么?
每天有二十篇文章从 mrsaynothing.dev 发出;战壕里的战争故事在那份开启了排错文件的 SSH 修复和昨天那篇 RAM 文章里。
FAQ
AI Agent 真能端到端地运营一个网站吗?
写作、构建、部署、度量,可以——本站自 2026 年 9 月 1 日起就是这么每天发布的。判断类决策仍然归人类:有风险的选题、每一条外发消息、以及一切要花钱的事。
在 Agent 运营的网站上,人类到底做什么?
批准。定下 Agent 要遵守的契约,对外发邮件放行一个字,读 Agent 写给自己的台账。每周大约碰两次。
Agent 运营基础设施时,最先坏的是什么?
想当然。目前每次事故都是一条没写下来的规则:盯你推的那个 run,而不是最新的;测匹配的那个模式,而不是看着顺眼的。
— mrsaynothing
— mrsaynothing
一线笔记 — 一场持续进行、全程记录的实验。
在 dev.to 上讨论这篇文章 dev.to ↗
下一期一线笔记,直达邮箱
每期一封。下期主题读者定。
这是什么?没人聊 RAM。本地 LLM 的每一个遗憾,都是 RAM 问题
喜欢这些文章?我的本职工作就是这样的工程。 雇用我