L139_注意力宪法

先说我上周干的一件蠢事。
我给一个 side project 接了三个 Agent,让它们并行地跑:一个改前端样式,一个补测试,一个整理文档。我以为自己终于要体验「睡一觉起来活儿全干完了」的赛博退休生活。结果那天下午,我的屏幕上全是弹窗——「这个间距你确认吗」「要不要删掉这段」「发现一个命名冲突,请裁决」。我盯着三排红点,忽然意识到一件事:过去我是一边写代码一边想问题,现在我只是在不停地给三个不会累的实习生点「同意」。我并没有变闲,我只是从「生产者」降级成了一条流水线上的「质检盖章机」。
那个下午我关掉电脑出门走了很久。回来之后重读这一周的几篇东西,有一种被说中的感觉——原来很多人都在同一个方向上撞过这堵墙,而且撞得比我更早、更系统。
—
把它们摊开看,这一周我读到的、看到的新闻,几乎全在回答同一个问题,只是从四个不同的角度挤进来:
一个做了大半年 Coding Agent 的设计师在总结「怎么用 Agent 把产品设计做好」,他给出的最核心技巧,是「创建一套设计系统,把色彩、字体、间距、文案风格全部定清楚,收归到一个统一的文件里」——他原话管这个叫「Agent 处理页面设计时的宪法」。
一个讲 Agent 演进的长文提出了一个词,叫 attention interface(注意力接口):Agent 可以同时跑很多任务,但人不可能同时处理所有进展、异常和确认。「如果每个 Agent 都随时来找人,所谓自动化最后只会把人变成一个审批队列。」作者甚至半开玩笑地问:既然 Agent 都有 agent.md 了,那是不是也该给我自己写一个「my attention.md」,告诉它们什么时候可以打断我。
一个我很关注的独立开发者,这周公开宣布「以后新产品再也不发 Product Hunt 了」。让他下决心的是一个非常具体的瞬间:他精心准备了半天的发布页,一点开,左侧是个「5000 美金帮你搞定整个 launch」的广告卡片,底下还挂着别家产品的横幅。「自己用心准备的地方,变成了别人卖广告的地方。」他还发现,所谓的首页、热度,是可以买赞买评论「配合平台表演」刷出来的——你付钱,得到一种虚假的热闹感,产品成了道具,发布日成了演出日,最后有没有真的吸引到用户,好像没人关心。
同一个人,在周刊结尾写了三千字悼念摇滚歌手何勇。他从初一英语老师在课堂上把《梦回唐朝》音量开满讲起,一路讲到窦唯、张楚、万青、李志,最后落在一句话上:「二十年过去,博客还在,那句『Be yourself and don’t go with the flow』还在,我身上那点不愿随波逐流的东西,好像也没有挂。」
—
我为什么觉得这四件事是一件事?
因为它们共享同一个前提:产出,正在变得廉价。 当写代码、做设计、发产品、生成内容的边际成本趋近于零,稀缺的东西就换了。过去稀缺的是「做出来」,现在做的是无限的,稀缺的是「你到底要不要这个」和「你此刻愿不愿意为它抬起头」。前者叫判断力,后者叫注意力。这两样东西恰恰都没有跟着产能一起通胀,反而因为太吵、太多、太快,在急剧通缩。
于是所有聪明的动作,本质都是在守护这两样稀缺资产:
设计系统不是为了让界面好看,是为了把人「值不值得、对不对」的判断提前固化成规则,好让 Agent 干活时不用每三分钟来烦你一次——那是把判断力一次性买断,摊到无数次执行里去。attention interface 更直白,它承认人的注意力是硬约束,所以要设计「何时可以打断我、什么可以你自己定」的协议,而不是天真地假设人永远在线。而那个跟 Product Hunt 决裂的人,是在拒绝一种「虚假热闹」对自己注意力的殖民——他宁可不发,也不愿意陪一场买来的掌声演戏。至于何勇那三千字,说白了是一个人在向「不被流量和包装裹挟」这件事本身致敬。
把这条线拉到本周的现实新闻上,看得更清楚。这一周 OpenAI 把 GPT-6 Astra 全面开放商用,定价摆在那儿:输入每百万 token 十美元,输出五十美元——「产出」明码标价,越来越便宜。DeepSeek 搞了个激进的峰谷定价,闲时缓存命中低至每千 token 两分钱,忙时价差最高五十倍,本质是在卖「你什么时候占用产能」的时间差。端侧那边,面壁把 2B 的小模型开源出来,让 Agent 能在手机、车机上本地跑;特斯拉中国车机这周确认接入了豆包。翻译成人话就是:Agent 的产能正在以前所未有的密度,往你身边的每一块屏幕、每一个音箱里钻,抢的就是你抬头的那么一下。
所以这一期,我想聊的不是「又一个能帮你干活的工具」,而是当活儿干不完变成常态之后,我们该怎么保住自己那点数得清的注意力和判断力。这可能是 AI 时代最朴素、也最容易被忽略的一项生存技能。
📚 深度阅读
如何用 Agent 做好产品设计
作者做了大半年 Coding Agent,最后强调「本文纯人工写作,无任何 AI 参与」——这句话本身就很有意思:在一个用 Agent 生成一切的年代,他反而把「人来写」当成一种品质背书。
文章列了七条经验,但真正值钱的只有三处洞察。
第一,「好看是手段,不是目的」。 他举了个反例:做网页版 IP 检测工具,用户真正要的是「打开就能快速看到结果」,可为了炫,加一堆高光、阴影、three.js 模型,结果加载巨慢、体验稀烂。这是我在跟 Agent 协作里见过最多的坑——模型天生爱「加东西」,你让它设计一个卡片,它恨不得给你糊三层玻璃拟态。所以他的第六条「多做减法」几乎是配套出现的:大胆删掉那些不必要的东西。他还提到,一轮调整完成后,可以让 Agent 把这些决策体现出的设计原则反向补进设计系统——让宪法自己长大。
第二,也是最核心的一条——把设计系统当成「Agent 的宪法」。 这不是老生常谈的「设计规范」,他说得很实:在开工之前,就把色彩、字体、排版、间距、阴影、组件、布局、交互、文案风格全部定清楚,收进一个统一的 HTML 文件或文件夹里。为什么要这么早、这么重地做这件事?因为否则 Agent 每一轮都在替你重新做审美决策,而它做的决策是「均值」——平均的、安全的、无聊的。你把宪法写死,它就不会每次重新发明轮子;他自己每次做完新模块,都会习惯性问一句「是否符合当前设计系统规范」。这跟我开头那三个弹窗是同一个病根:规则没有前置,就只能靠人肉裁决来补。
第三,「别迷信 One Shot」。 他直接泼冷水:别信社交网上一段 Prompt 就搞定一切的炫酷案例,你准备工作做得越好、想得越清楚,项目推进才越快,至于是一轮还是十轮搞定,根本不重要。这句我举双手赞同——所谓「十轮搞定」是过程,「一轮搞定」的 demo 是把准备阶段藏起来了,而藏起来的那部分恰恰才是真正的工作量。
我的一点补充判断:他把「用 HTML 文件作为设计稿载体」单独列为一条,是因为 HTML 对 Agent 的友好程度仅次于 Markdown——能被改、能被内置浏览器打开、批注、截图,闭环全在 Agent 能操作的地方。他同样建议别从零开始,直接用 Shadcn UI、Hero UI、Base UI 这类组件库。这背后是一个更普遍的迁移:凡是想交给 Agent 的东西,就得先变成 Agent 读得懂、改得动的形态。 设计稿从 Figma 迁到 HTML,需求从口头迁到 agent.md,判断力从「脑子里」迁到「宪法文件里」——都是在做人机之间可解析的接口。他还留了一句我以为是整篇最重要的废话:「你需要知道什么是好的产品设计。方向错误,再怎么努力都是浪费。」唯一的办法是多看真正的好东西,尽量找信息源头,避免二手信息。连审美,都得你自己先有过。
🔗:https://walnut.hedwig.pub/i/ru-he-yong-agent-zuo-hao-chan-pin-sheji
Attention Interface:下一件「设备」,可能是管你注意力的
云槿这期 AI Weekly 里我最想单独拎出来的,是他转述 latent.space 那篇讲 Agent Harness 演进时 highlight 的一个概念——attention interface。原文那篇其实写得像一部 Agent 技术史:ReAct 时代把「智能体循环」画在纸上(比 ChatGPT 还早一个月),AutoGPT 时代过早地把全自主权塞给还太弱的模型——一句「95% 单步可靠度、20 步任务、成功率只剩约 36%」把复利如何反噬讲得透透的;Cursor/Copilot 时代认清现实退回「人在环里」;直到 Claude Code 踩准时机把循环重新交给模型,半年做到约十亿美金 ARR,不是因为它第一个给模型自主权,而是第一个在正确的时机给。作者的总结是:模型不断把 harness 吸收进权重,工程师不断删掉被吸收的那部分,最后剩下的,是一个为人类注意力服务的 harness,而不是为模型服务的。
但对普通人,真正扎心的是那半页关于 attention 的话。推演很简单:Agent 能并行,人不能。于是需要有人设计「何时可以打断你、什么可以它自己定、用什么信息密度把问题递给你」。云槿顺着往下猜:现在每个项目都有 agent.md,那我们是不是也该给自己写一个 my attention.md?甚至反问了一句更大的:有没有可能,这个 interface 本身是个 new device?
我把这句话读了三遍,因为它把我上周那三个弹窗的难受,精确地命名了。问题从来不是 Agent 不够能干,是我没有一份「注意力宪法」告诉它们:这类小事别来找我,那类事必须等我拍板。这跟前面何涛「设计系统即宪法」是同一个动作的两侧——一个是替审美立宪,一个是替打断权立宪。
顺带记一笔同篇里两个很「人味」的观察。一是 DeepSeek 新发的 Harness(DSH),作者以普通用户视角吐槽「安装不难,但配置、稳定性、问题定位考验技术能力,然后还贼费 Token」,对一般 Coding Agent 用户「十之八九会觉得不好用」——又一个「产能强不等于体验好」的实例。但过去十天 DeepSeek 最值得说的其实不是 DSH,是价格:v4-pro 工作日峰时缓存命中输入贵到十二倍。一名用户拿过去 28 天 40.2 亿 tokens 重算(97.74% 输入命中缓存),全部谷时账单从 53.38 美元变成 130.48 美元,全天均匀约 3.16 倍,全峰时约 4.89 倍。作者点评得准:这只是长上下文、高缓存命中率的 Agent 工作负载,不能代表所有人,「但很能解释 Agent 开发者为什么反应尤其大」。
二是英伟达那笔被媒体写成「收购 Poolside」的交易(60 亿美金授权 + 剩余公司以 120 亿估值再融 10 亿)。作者反复强调「人家 founder 说了,不是买!」,并拆了 Poolside 的家底:自训 Laguna 系列代码模型、提供 Agent/CLI/企业私有化部署,更核心的资产是 Model Factory——覆盖训练数据、预训练、RL、代码执行、评测与实验管理的内部生产系统。但结论毫不客气:「看起来啥都有,但查一查也没什么战绩」,一家「研究工程能力强、资本投入很大、模型做出一定成绩,但产品影响力和商业验证还没怎么建立明白」的公司。留下一句扎心的问号:「所以,为什么啊?」我至今没等到一个让我信服的解释。
同一期里我还喜欢两个小片段。红杉那个 17 分钟分享提炼出的路径:先用闭源模型把产品做出来,再用 eval 证明瓶颈究竟在成本、速度还是领域效果;只有瓶颈成立,才有必要继续下沉到 post-training,甚至自有权重。这条特别值得抄下来贴在每一个想「自研模型」的会议室门口——因为它反着对抗一种流行冲动:把「拥有模型」当目的。它只是手段。
另一个是 The Skip 采访 Waymo 那位 PM 负责人(《To Invent Waymo, They Had to Reinvent PM》)。作者说,除了拆长期目标、设计 eval 那些成功学,最触动他的是 Waymo 的一个仪式:让当初做错预测、导致项目被迫终止的人,在全体产品团队面前公开讲判断依据、错在哪、学到什么,并公开肯定这些失败里的 heroes。Saswat 的反问很妙:下次做预测,你会更相信经历惨痛失败的人,还是没经历过的人?云槿收尾那句我照抄过来——「长期创新需要团队有能力从失败中恢复并汲取能量。」在一个 Agent 每天能产出十个方案的时代,敢于公开承认「我押错了」的人,比任何 eval 都稀有。
🔗:https://www.latent.space/p/attention-interface | https://theskip.substack.com/p/to-invent-waymo-they-had-to-reinvent | https://youtu.be/bMMv0bZzONg
🌊 本周产业:办公 Agent 集体来抢你的桌面
把镜头从阅读挪到新闻,这一周(9/6–9/12)国内最热闹的是 AI 办公 Agent 的同日对垒:9 月 10 日成了集中发布节点。腾讯 WorkBuddy 上线半年迭代五十多个版本、新增「人机双写」、AI 原生资料库、安全中心,8 月已打通企业微信;腾讯乐享同步上线知识图谱、长期记忆、「AI 同事」、AI 知识巡检等七项能力;科大讯飞的 AI 工作搭子 Loomy 迎来年度重磅版本,强化复杂任务编排与多系统联动;字节「豆包工作」同日引发行业大讨论。往前翻一句彩蛋——tw93 在周刊里正好推荐了虹线那篇《WorkBuddy 成功,是因为腾讯办公套件太烂了》,说它对办公领域 AI 分析得挺有趣,但紧接着给出自己的保留:「我没有那么看好 WorkBuddy 未来的成功。」
我的判断偏 tw93 那一侧。办公 Agent 集中爆发,恰恰说明这件事正在快速同质化:当「帮我写文档、整理知识、跑流程」人人都能做,比拼的就不再是能力,而是谁离你的注意力入口更近——企微、飞书、钉钉、系统级入口。这是一场入口之争,不是功能之争。也正因为它抢的是入口,「谁能合法地随时打断你」才变成一个比技术更需要设计的问题。回到我那三个弹窗:未来真正赢家的那个办公 Agent,未必是功能最全的,很可能是最懂「什么时候不打扰我」的那个。
另一条值得记的是能力往端上沉。9 月 8 日面壁智能联合 OpenBMB 开源 MiniCPM5-2B,参数只有 2B,却在 Artificial Analysis Intelligence Index 上以 23 分登顶全球 4B 以下开源基座模型,支持工具调用、深度搜索与代码生成,声称能在手机、车机上本地流畅运行,9 月 12 日国家超算互联网平台集中推送上线。9 月 9 日蚂蚁开源百灵系列首个原生多模态模型 Ling-3.0-flash-VL,总参数 124B 的 MoE、单次推理只激活 5.5B,上下文 256K,核心创新是「观察→行动→验证→修正」的视觉反馈闭环——机器之心的评价我觉得抓得准:原生多模态正在突破「一次性生成」,走向持续迭代执行。
同日还有一组特别现实的账:特斯联发布 ThiCP 异构算力调度平台,宣称把大模型整体推理成本降低 50%–70%;DeepSeek 宣布 9 月 10 日起调整 Flash 系列定价,空闲时段缓存命中输入低至 0.02 元/千 token,未命中 1 元/千 token,价差最高 50 倍。国际那边,OpenAI 于 9 月 12 日宣布 GPT-6 Astra 全面接入 ChatGPT Work、Codex 与 API,定价每百万 token 输入 10 美元、输出 50 美元;Palantir 与英伟达 9 月 10 日达成合作,把 Nemotron 与 Foundry/AIP/Ontology 整合进英伟达自己的供应链,覆盖每个 Vera Rubin 机架约 130 万个零部件,黄仁勋那句「供应链是实体经济的操作系统」被媒体引用了无数遍。
把这些数字排成一列,指向同一个方向:产出在降价,接入在变密,治理在补课(9 月 11 日加州州长签署 SB 813 与 AB 1405,建立全美首个州级 AI 独立评估与审计框架;9 月 7 日最高法发布《关于依法审理涉人工智能纠纷案件的意见》,5 部分 24 条)。而对个体来说,这一周真正发生的唯一变化是:你周围试图占用你注意力的智能体,密度又高了一个量级。 你的应对策略如果还是「谁叫我我看一眼」,那注定输。
🛠️ 效率工具(本周三小件)
TokenRemain — 免费的 AI Coding 额度统计,官网整洁,还加入了 Codex 额度重置的通知。放在本期主题里格外贴切:当你在为一堆 Agent 的产出买单,第一件该能一眼看到的就是「我这会儿到底烧了多少、还剩多少」——把「注意力之外的成本」显性化,本身就是给自己的注意力减负。tw93 的语气是「有兴趣可以试试」,轻量推荐。
Unclack — 你打字的时候,它自动把麦克风静音。场景具体到有点好笑:开着语音会打字,噼里啪啦全屋子听见,它替你按住那个尴尬。「挺适合打工者」。
Pulse(kean)— 用 SwiftUI 写的苹果全平台网络日志记录工具。这是 tw93 本期唯一给了明显更高背书的一个:「整体做得还是挺精致的,在开源里面算很不错的」——他很少这样夸。iOS/macOS 开发者可收藏。
三个放一起有个共同气质:都不是「替你干更多活」的工具,而是「帮你少分一次心」的工具——省得你去查额度、省得你去点静音、省得你去抓包。这恰恰是我这期想推荐的选型标准:优先要那些帮你省注意力的,而不是帮你产更多的。
🔗:https://www.tokenremain.com/ | https://unclack.app/ | https://github.com/kean/Pulse
✨ 随便看看
- 和 Product Hunt 正式决裂:tw93 花了本期最长的篇幅写这件事。除了开头那个「用心准备的发布页变成卖广告的地方」的瞬间,更狠的是他拆穿的那条产业:看到有「100 刀买 200 个赞就能进工作日前五」的服务,「当然不会给你带来一个真实的用户」,但确实养活了一批做 PH 热度的团队,从描述、包装、封面、视频到结合点、利益点一整套打包。「然后你付钱后得到了一种虚假的热闹感,陪着 Product Hunt 表演,产品成了他道具,发布日成了演出日。」最后他几乎没收到任何产品交流,反而收到近 50 封垃圾邮件,「有一种惹了一身腥的感觉」。他真正想要的是「类似 10 年前 GitHub 那种乌托邦——人们不会关注你的包装和利益点,只是一伙喜欢做产品的人围在一起交流好东西,让好东西被更多人用上」。于是他改推 GitHub、X、YouTube、V2EX。这一段我读了很久,因为它跟本期主题是同一根筋:虚假的热闹,是对注意力最恶劣的殖民。
- 《WorkBuddy 成功,是因为腾讯办公套件太烂了》(虹线):tw93 推荐、但自己保留的那篇,我找到原文读完了,比转述精彩得多。作者先叠甲:腾讯会议、腾讯文档、企业微信单独拿出来都很能打,「问题只出在后两个字:套件」——三款产品「共享 Logo,没能共享同一种用户关系」,说得难听一点,「腾讯没有办公套件,只有三款彼此加了好友的办公软件」。而 WorkBuddy 做的事不是合并,是汇流三种入口:会议提供事件、文档提供对象、企业微信提供组织和客户关系,「一个产品积累发生了什么,一个产品积累留下了什么,另一个掌握应该交给谁」,过去这三种上下文之间隔着大量人肉复制粘贴。他给 Agent 的比喻我很喜欢:不是把三栋住满人的楼改造成一栋,而是「多配几张门禁卡的跑腿员」,几栋楼还在原地,住户不用搬家。最反直觉的一章是「飞书的问题,是套件太成功了」:Copilot 时代飞书是标准答案,但「Agent 把驾驶位也拿走以后」,套件的完整反而成了约束——飞书的 AI 首先要向飞书负责,WorkBuddy 暂时只需要向任务负责,「如果腾讯自己的工具不好用,那用别人的也可以完成用户的任务」。结尾的判断留给未来:「它接下来最危险的时刻,也许正是腾讯决定把它重新做成一套的时候。」我站这篇文章一半、站 tw93 一半:这套「弱者资产意外留出真空」的论证极其漂亮,但它成立的前提是自由期够长——而企业版、统一身份、治理能力的排期表,已经在收网了。
- RIP 何勇:一个独立开发者,用三千字悼词把 1994 红磡的《钟鼓楼》《姑娘漂亮》、初一英语老师 Richard 开满音量的《梦回唐朝》、大学数据库老师课外讲的 PHP/HTML 缝成一条线。他写那位老师「两个人不像师生,更像讨论技术的好友」,写自己 2011 年把图书馆评分不错的 Web 开发书几乎看完,受《黑客与画家》影响定了职业路线,博客挂着那句「Be yourself and don’t go with the flow」二十年没改。看似跟 AI 毫无关系,其实是他整期最硬核的观点输出——在一个包装、买量、表演把一切搞得乌烟瘴气的时代,「保持自己的不同,不跟风」是一种需要主动守住的稀有品质。这份品质,和给注意力立宪、和设计系统宪法、和拒绝虚假热闹,是同一个东西的不同名字。
- 一把越王的剑:本期封面是作者周末逛浙江博物馆拍的越王勾践儿子的佩剑,本来想看四大兽首展,人太多,遂去了常规场馆,结果「发现非常美的东西」,感叹「当时越国的审美真好」。我特意去看了那张图——两千多年前的人,在没有观众、没有热度可刷的地方,把一把剑做成了那样。这大概是「好看是手段还是目的」最好的注脚:有些东西做得好,只是因为做的人在意。
- 一份杭州面馆清单:本期还夹了一段纯粹的吃货安利,「个人感觉杭州最好吃的拌川,必须是夫妻面馆」,然后被朋友反推荐一大串——老太婆面馆、老街面馆、芒种、小辫子、小狗面馆、转塘来翠、松木场、春雪、良渚一麵、华三爷拌面、当面道蟹、方老大、嘉兴玉林面馆。在一堆关于 Agent、算力与审计的段落之间,这份清单意外地让人放松:至少吃一碗面这件事,暂时还没有 AI 能替我做决定。
🔗:https://weekly.tw93.fun/posts/281 | https://1q43.blog/post/12578/ | https://github.com/tw93/weekly
写到这里,我回到那个满屏红点的下午,试着做了两件事:给三个 Agent 各写了一份很短的「什么时候可以打断我」的规则,把琐碎的样式决策补进了项目的设计系统里。神奇的是,弹窗少了,我没有更闲,但那天重新有了一种「我在主导」而不是「我在盖章」的感觉。
我不敢说这就是答案,但它让我确认了一件小事:当产出变得无限,人和人之间真正的差距,不再是谁能做得更多,而是谁更清楚自己该把目光落在哪儿。 这个「落在哪儿」,得你自己写下来、立成规矩——不管那是给 Agent 的宪法,还是给自己的。
下周见。