2026年10月3日super-user

超级用户日报: 2026-10-03

10 月 1 日是 Mods 日。Anthropic 把 Claude Code 本身开放给几行 TypeScript 去改,几个小时之内就有人做出了:把 agent 正在干什么实时画成小漫画的加载动画、带音效的进度条、列出 Claude 碰过的每一个网址的侧边栏、自动判断命令该在本地还是沙箱里跑的闸门,还有一个苹果提醒事项侧栏。更值得看的是这些 mod 都在解决什么:几乎每一个都是让 agent 的工作变得看得见,因为用户最不放心的,就是自己移开视线那段时间里发生的事。另一半内容压根不是写代码。一块机器人电源板从第一次提交到下单 JLCPCB 不到 24 小时,一位哈佛物理学家三个月跑了 18 个领域 36 篇稿子,一家拿 800 美元月费的 WordPress 外包几天做完了客户好几年的积压,一个改游戏的技能包一夜反编译了泰拉瑞亚、加上了追踪导弹。OpenClaw 用户一整天都在拿自建方案和 Dots 比,留下来的人给的理由非常具体:GPS、环境对话、聊天记录实时喂进去,以及坏了能自己修。
@VectorCrossProd [Claude Code]
Claude Code#1
https://x.com/VectorCrossProd/status/2105573388878270839
VectorCrossProd 做了一块真实的 PCB,全程没画一张原理图、没手动摆一个元件,从第一次提交到在 JLCPCB 下单不到 24 小时。脚本全是 Claude Code 写的,干活的是 KiCad、Freerouting、FreeCAD 和 Blender,作者只在事先定好的检查点审一下。这块板叫 Kookabus-01,64 乘 62 毫米的机器人电源板,两组电池进、一路负载出,理想二极管热插拔保证负载不掉电,INA226 通过 Qwiic 报告电压、电流和功率。原理图、布线、Gerber、BOM、贴片文件、数据手册、外壳乃至宣传片,全部从一份文字需求里生出来,现在板子正在组装。
@yupi996 [Claude Code]
Claude Code#2
https://x.com/yupi996/status/2105461946208354750
yupi996 拆了 universal-modder 这个开源技能包:有人让 Opus 5.5 连夜反编译泰拉瑞亚,第二天醒来游戏里多了追踪导弹和战术核弹,经验就整理成了它。装进 Claude Code 后,你说一句想改什么,它就自己反编译、画贴图、做音效、进游戏实测,连演示视频都自己剪。比改游戏更值得抄的是它给 AI 定的规矩:边干边写日志,上下文被压缩了也不会失忆;同一个错误出现三次就必须停下换思路;改没改好只认游戏里的截图和日志,AI 自己说改好了不算。最好笑的一条是禁止用 pkill -f 杀进程,因为会把 agent 自己也匹配进去一起杀掉。
@vegardwikeby [Claude Code]
Claude Code#3
https://x.com/vegardwikeby/status/2105722450126508091
vegardwikeby 在 Claude Code 里给客户的 WordPress 站干了一周,说这位客户每月 800 美元的维护费本来永远覆盖不了的好几年工作量,几天就做完了。重做后每个页面的 Lighthouse 都在 100 分或接近 100 分,插件从 25 个以上砍到寥寥几个,过时主题换成了定制的原生 Gutenberg 主题,页面合并、转换的同时保住了所有重定向,还把新 sitemap 和旧的逐条对过。多语言部分走 WPML 的 XLIFF 导出导入,因为 Claude 翻出来的语气比机翻贴客户得多。作者预计下一个站只要一半时间,因为这次的完整对话马上会被整理成一份计划和一串提示词。
@Klonzu [Claude Code]
Claude Code#4
https://x.com/Klonzu/status/2105738188115329460
Klonzu 转述了一位哈佛物理学家的用法:三个月里用 Claude Code 跑了 18 个领域、36 篇稿子。配置简单到可以直接抄:一个项目一个会话,一个总控会话协调其他会话,长任务交给子 agent,所有结果都存成 markdown。最值钱的是那句警告:Claude 特别爱宣布胜利。它曾经为一个证明得意洋洋,可那个证明靠的是一条没证过的引理,而那条引理恰恰就是整个证明本身。
@lbtech [Claude Code]
Claude Code#5
https://x.com/lbtech/status/2105747234071388189
lbtech 把一台 Linux 机器变成了一支软件团队:agent-stack 以真实团队的方式跑着大约 70 个 Claude Code 和 Codex 会话,每个项目一队,有负责人、架构师、开发、测试编写、评审、QA 和集成者,由 OpenRig 通过一个持久化工作队列协调。每个改动都走同一条路:先写测试并锁死,agent 开发,由另一个模型家族的评审来检查,QA 测试,合并闸门针对那一个具体提交决定合还是不合,最后再派一个全新的 agent 像真人一样把功能从头用到尾。rig-console 是指挥台,谁在干活、谁闲着、谁卡住了以及卡住的原因、实时终端、模型额度和系统状态一屏看全,只占一个核的大约 1%。跨家族评审是关键细节,同一家族的两个模型往往会漏掉同样的 bug。
@GoSailGlobal [Claude Code]
Claude Code#6
https://x.com/GoSailGlobal/status/2105598715394474433
GoSailGlobal 拆了创作者黄白开源的三个 Claude Code 技能,一句话出一条完整口播视频:写稿、数字人口播、B-roll、合成、抽帧检查一条龙。写稿技能先学你往期视频的风格,输出三列分镜表,每段口播不超过 15 秒;口播画面用即梦 Seedance,一张正脸照加 8 秒本人声音逐段生成,再用 whisper 逐字核对,念错哪段只重跑哪段。粗剪的硬规则都是踩坑换来的:只在停顿里下刀,剪点吸附到正负 0.25 秒内最安静的 20 毫秒;倍速按帧率选,25 帧用 1.2 倍、24 帧用 1.25 倍,正好映射到 30 帧不重复;每句讲完留 0.5 到 1 秒气口。所有花钱的步骤一律先报价,等你说提交才提交,交付前每 2 秒抽一帧拼图逐张看,响度统一到 -14 LUFS。
@redp314 [Claude Code]
Claude Code#7
https://x.com/redp314/status/2105647218992550335
redp314 看到 Opus 5.5 拼了一只乐高小鸭,好奇两千年前的版本会是什么样,于是让 Claude Code 做一幅罗马马赛克。成品有 7878 块镶片,每一块都是一颗真实的 3D 石头,像马赛克匠人那样一行一行铺上去。没有图像模型,也没有视频模型,只有在浏览器里跑的代码,放大到眼睛那里依然经得起看。这说明代码已经可以当作手工艺类视觉作品的媒介,而不只是用来画图表。
@anshuc [Claude Code]
Claude Code#8
https://x.com/anshuc/status/2105773281936650247
anshuc 在 Mods 上线第一天就 vibe code 了一个自定义加载动画:它盯着主 agent 在干什么,再用 Sonnet 5.5 实时画成小漫画。这是目前对 agent 干活时那段空白时间最可爱的回答,你看到的不再是闪烁的光标,而是一段实时配图的解说。同一位作者还把 Doom 塞进了 Claude Code 的加载动画里跑。确实很无聊,但它说明新钩子插得有多深:连界面循环本身都归用户了。
@brankopetric00 [Claude Code]
Claude Code#9
https://x.com/brankopetric00/status/2105759582261760488
brankopetric00 发现 Claude Code 查资料时你只看得到答案,看不到出处,于是做了一个 mod,把 Claude 碰过的每一个网址实时显示在终端里。搜索、网页抓取、curl 调用、浏览器标签页都算在内。实际用处是核对来源,在 agent 读了过时文档、准备往上盖楼之前就把它抓住。仓库已经公开,这正是过去大家只能提 feature request 等官方做的那类透明度功能。
@kirillvserditov [Claude Code]
#10
https://x.com/kirillvserditov/status/2105790255144063241
kirillvserditov 在 Mods 上线后用一个会话就做出了计划进度条,有阶段、有音效,还能同时显示好几个并行任务。一份长计划从此变成隔着半个房间瞟一眼就懂的东西,不用再翻滚动记录。一个会话就做完,说明现在按自己的注意力习惯改造工具的门槛有多低。
@dani_avila7 [Claude Code]
Claude Code#11
https://x.com/dani_avila7/status/2105754717854777361
dani_avila7 发布了一个 Jev 加 Vercel Sandbox 的 Claude Code mod:它在 Vercel 上开一个沙箱,再由小型决策模型 Jev 判断哪些命令该进沙箱跑、哪些可以在本地跑。用 claude-code-templates 一条 npx 命令就能装。这正是 Mods 打开的模式:把一个便宜的分类器直接放进 agent 循环里当安全闸门,而不是在 CLAUDE.md 里再加一行求模型小心点。
@viticci [Claude Code]
Claude Code#12
https://x.com/viticci/status/2105785691569533333
viticci 发布了 RemCTL 2.1.0,自带 Claude Code 插件和 mod,苹果提醒事项可以直接显示在 Claude Code 里。今天还剩什么没做、某个清单里还有什么,随时看得到,还有一个侧边栏。事情不大,信号不小:编码 agent 的窗口正在变成人们想看到一整天安排的地方,而不只是代码仓库。
@attacomsian [Claude Code]
Claude Code#13
https://x.com/attacomsian/status/2105768990274715653
attacomsian 之前用 Claude Code 做出了 Vitals 和 Flit 两个产品,第一个 mod 做的是最朴素的需求:长任务跑完就提醒,不用一直盯着终端。这大概是最小的 mod,生活质量回报却可能最高。最有意思的是它闭合的那个循环:Claude Code 造了作者的产品,现在作者反过来改造 Claude Code。
@Av1dlive [Claude Code]
Claude Code#14
https://x.com/Av1dlive/status/2105757532790903192
Av1dlive 在动手写 mod 之前先做了一件聪明事:让 Claude 把自己的 Codex 和 Claude Code 工作流过一遍,判断哪些反复出现的问题该做 mod,哪些该用 hook、skill 或改设置解决。建议很具体:压缩前自动存进度的上下文守卫,盯磁盘空间和孤儿进程的看门狗,抓住重复失败尝试的循环检测器,把值得存成记忆的纠正挑出来的复盘步骤,以及检查重复 hook 和无依据署名的发帖检查器。先挖自己的会话记录是正确的顺序,值得做的 mod,就是回答那些你总是停下来要问的问题。
@mikepat711 [Claude Code]
Claude Code#15
https://x.com/mikepat711/status/2105613676287824216
mikepat711 让 Grok Bot 给 Cursor 派活:Cursor 在云端起了一个协调 agent 和两个工人,搭出一条讲解视频流水线,再把它交给住在作者 Mac Mini 上的 Cursor 工人。现在流程是定死的:Mini 上登录着 Claude Pro 订阅的 Claude Code 负责调研、写稿和动画方案,Python 画动画,Kokoro 配旁白,ffmpeg 加音乐字幕并导出,成片存进 iCloud。以后每做一支科普视频,只需要给 Grok Bot 一个题目,除非要改流水线,否则根本不动用云端 agent。第一支成片讲的是电网怎么运作。
@takuchang_n [Claude Code]
Claude Code#16
https://x.com/takuchang_n/status/2105574112030503234
takuchang_n 公开了一支成片背后的工具链:Fable 5.1 上的 Claude Code 统筹整个制作并操作各个工具,Higgsfield 出人物图和视频,ElevenLabs 负责配音、配乐和音效,After Effects 做合成和文字动效。关键在于 After Effects 是 Claude 通过 MCP 直接操作的,也就是让 AI 能直接驱动应用的那座桥。让 agent 驾驶专业动效软件,和生成几段素材再拼起来,是两类完全不同的事。
@shupeiman [Claude Code]
Claude Code#17
https://x.com/shupeiman/status/2105634243200385531
shupeiman 用三台 iPhone 加一台 Osmo Pocket 拍了四个机位,把素材一股脑丢给 Claude Code,让它剪成 Pivot 那种风格。Opus 5.5 处理多机位毫不费力,作者说一次修改都没做。多机位剪辑过去是让独立创作者只敢用一个机位的那道坎,这类杂活正在悄无声息地消失。
@sl1ma4 [Claude Code]
Claude Code#18
https://x.com/sl1ma4/status/2105592053874700360
sl1ma4 给 Claude Code 一句提示:给 Uptimepage 做一支 30 秒动态图形视频,别太快,让人真能看懂,用 three.js。26 分钟后成片出来了,1080p60。用的是 Sonnet 5.5,花了 6.74 美元,输出 20.4 万 token。这三个数字才是重点:产品发布视频从此是一项能编预算的开销,而不是一次找外包的过程。
@tsubotax [Claude Code]
Claude Code#19
https://x.com/tsubotax/status/2105526804870246862
设计师 tsubotax 解释说,不再用 Figma 并不等于把设计交给 AI。判断和试错依然是自己做,甚至比以前做得更多;变的是把判断变成实物的方式。现在通过 Claude Code 用自然语言比较字距、试好几版动画、调 SVG,然后直接落到实现,一气呵成。重点在于 AI 替代的是自己原本不擅长的软件操作,过去被工具熟练度卡住的想法,现在设计师自己就能做出来。
@MichLieben [Claude Code]
Claude Code#20
https://x.com/MichLieben/status/2105778817327616411
MichLieben 把 Claude Code 接上自家 CRM folk 和 ColdIQ 的 MCP,同时追踪 2000 多个产品注册用户,写下了在再买一份线索名单之前该做的几件事。把过去 12 个月丢掉的单子拉出来,让 Claude 读通话记录,在每个账户旁边写上买家当时的原话异议,再去核实这个异议现在还成不成立:当时缺的集成现在支持了没有,当时拦单的人还在不在那家公司。追踪当年替你说话的内部支持者跳槽去了哪里,先评估新公司再开单;拿留出的数据检验 ICP 标准到底能不能区分赢单和丢单;注册用户一开始结账就通知负责人。全程的纪律是先有证据:只有当你能说清这次对话为什么会不一样时,才去写跟进邮件。
@RCIllingworth [Claude Code]
Claude Code#21
https://x.com/RCIllingworth/status/2105734564802933155
RCIllingworth 两年发了 5000 多万封冷邮件,最近把整套流程搬进了 Claude Code,说过去要一整周的手工活现在一个下午做完,产出质量一点没掉。作者的判断是:冷邮件很少是文案问题,问题几乎总出在从找公司到读回复这一串可重复步骤里的某个环节。新流程从 ICP 到发送后分析一共七步,按一级、二级分桶决定先打谁,并行补全数据的技巧让 250 个联系人的补全从 Clay 里 12 小时的活变成 30 分钟。发送后的复盘循环负责决定哪些邮件重写、哪些直接停掉。
@codyschneider [Claude Code]
Claude Code#22
https://x.com/codyschneider/status/2105764696691192319
codyschneider 的观点是:你的 SEO 订阅干的活,还不如接上自家数据的 Claude Code。把 Search Console 和 GA4 导进数据仓库,给 Claude Code 权限,它就能找出排在第二页、值得推上第一页的关键词,改标题、小标题或正文把它们推上去,把搜索流量和你真正关心的转化对上,找出孤儿页面和通往赚钱页面缺失的内链,每周一往 Slack 发一份环比报告,再搭一个每小时刷新的看板。话说得很直白:一家每年给 SEO 代理付 6 万美元的 SaaS,该换的就是这个。
@masashi20555444 [Claude Code]
Claude Code#23
https://x.com/masashi20555444/status/2105768465957310772
masashi20555444 在 IT 咨询公司做了 20 多年资料,现在每周还要做两次,于是把做资料的过程变成了一套 Claude Code 流程,还出了一本书。输入 /資料作成,AI 只问四个问题;读完你放进来的材料,再追问其中的矛盾和缺漏;动手之前先停在大纲让你确认;最后逐项检查,用公司模板收尾。人要做的只有回答、选择和点头。和每次在聊天框里求它相比,区别在于每次问的问题都一样,产出永远符合公司格式,中途停下也能从断点接着做。
@neil_xbt [Claude Code]
Claude Code#24
https://x.com/neil_xbt/status/2105602120225333507
neil_xbt 实测了一个真实的 Claude Code 会话:60 轮里人只发了 7 条消息,agent 写出 5.9 万 token,却因为每轮都要重发整段对话,一共重发了 740 万 token。成本的 77% 花在重发上,只有 23% 是模型真正在写;60 轮里有 11 轮上下文超过 15 万 token,钱就是在那里烧掉的。五条规则能砍掉大头:先 grep 找到符号,只读前后 40 到 80 行;已经在上下文里的文件不要再读;互不依赖的工具调用合并到同一轮;只跑相关的那一个测试,不跑全套;超过大约 10 万 token 就写一份五行交接,开新会话。算出这些数字的计量器直接读 Claude Code 自己写的对话记录,零依赖。
@buildwithhassan [Claude Code]
Claude Code#25
https://x.com/buildwithhassan/status/2105693275252195748
buildwithhassan 以前以为 Claude Code 烧额度是因为写代码,后来才明白钱花在每一轮重读同一堆上下文上:抓进来的网页、扫过的文件、卡住的循环。改掉问题的习惯值得照抄:切换任务就 /clear,接近 15 万 token 前先 /compact,时不时看 /context,揪出那个工具清单巨长、每条消息都在收税的 MCP 服务器,删掉不用的 MCP 和 skill,跑 /insights 和 /skill-doctor。还有两条更隐蔽:会话别闲置超过一小时,缓存过期后得从头重建;小活别开子 agent,每个子 agent 都是冷启动从头建上下文。最高 effort 也不该当默认,有些模型上它多烧好几倍 token,结果只好一点点。
@CoinSh0t [Claude Code]
Claude Code#26
https://x.com/CoinSh0t/status/2105644753383494137
CoinSh0t 介绍了 Claude Code 2.1.283 内置的 /doctor prompt-audit:它会读 CLAUDE.md、skill、子 agent 和自定义命令,把所有为已经不存在的老模型写的东西标出来,比如新模型会过度反应的大写 CRITICAL 和 YOU MUST、一步一步思考之类的脚手架、指向已删除文件的路径、改过名的脚本、和 CLAUDE.md 自相矛盾的 skill。坑在于它默认跳过个人 skill 目录。文中举的例子里,一套有 49 个 skill、286 个子 agent 的配置,第一次跑 21 分钟出了 66 条问题,没有一条碰到 skill;加上 claude --add-dir ~/.claude 再跑,真正的烂摊子才露出来:从别人 Mac 上抄来的写死路径,还有四个 skill 调用的插件早就不存在了。两次一共花了 20.31 美元、大约 34 分钟,每次换模型之后跑一遍,是很便宜的保险。
@ai_suxiaole [Claude Code]
Claude Code#27
https://x.com/ai_suxiaole/status/2105486608946589861
ai_suxiaole 点名了一个人人都踩过的坑:Claude Code 写完代码,测试通过,类型检查全绿,告诉你任务完成,打开一用根本不行。反复叮嘱它仔细点基本没用,把什么时候才算完成写清楚才有用。作者交给 Claude Code 的提示是:先根据本次需求列出可观察、可判断的验收标准;跑已有的测试、类型检查和 Linter;启动应用,把受影响的关键流程实际走一遍;检查页面状态、接口响应和相关指标;对每条标准给出通过或失败以及证据;有失败就继续修、继续验;全部通过后,再汇报改了什么、证据是什么、还有哪些风险没覆盖。代码生成了,不等于任务完成了。
@ClaudeCode_UT [Claude Code]
#28
https://x.com/ClaudeCode_UT/status/2105507540041875867
ClaudeCode_UT 拿一个小的表单处理修复演示了 plan mode,当时实现方式还没定。在动任何文件之前,Claude 先把相关文件查了一遍,列出的不只是空字符串,还有纯空格、未传值和 null 几种情况,外加一个待确认问题:调用方期待的是抛异常还是返回错误。演示到给出计划就停了,还确认原文件一个字没改。在代码出现之前找到规格漏洞,是最便宜的找法。
@seiichi_satoweb [Claude Code]
Claude Code#29
https://x.com/seiichi_satoweb/status/2105796148623753422
seiichi_satoweb 推荐了一个给 Claude Code 写文章 agent 用的小技巧:加一个读者角色,并且不给它任何写作规则。因为没人告诉它这篇文章该达到什么目的,它的反应就像一个真实读者,会直接指出哪里看不懂。作者说加上之后,难读的段落明显减少。这相当于写作版的跨家族代码评审:一个不和作者共享前提的检查者。
@_3912657840 [Claude Code]
Claude Code#30
https://x.com/_3912657840/status/2105493320814448896
_3912657840 在 100 美元的套餐上跑一套以 Codex 为中心的系统,Sol 6.1 开 xHigh 同时跑多个任务,周额度也只用了大约 25%。从 ChatGPT Pro 导入的大型设计方案和大规模审计交给 Astra;Sol 卡住的时候,尤其是需要图形识别的任务,就交给 Opus 5.5,一边修一边找出 Sol 到底哪里做错了,再把结论沉淀成知识,回头调整工作流和 skill。为了在一个项目里同时用 Codex 和 Claude Code,作者搭了一个桥,让一个名叫たけし的 Dot 站在中间负责监控、推进和运营。Opus 等于是一位挂在 20 美元套餐上的流程顾问,按成本分工分得很聪明。
@Teslanaut [Claude Code]
Claude Code#31
https://x.com/Teslanaut/status/2105807710122086411
Teslanaut 让 Claude Code 管着一台 ComfyUI 机器:针对硬件测试各种模型配置,套用更新和优化,并把所有结果记录进一个 HTML 图库应用。这个应用的写代码工作现在转给了一台 M4 Max,上面跑着 Qwen 3.8 Flash Next 和 pi coder;生成的图由 Claude 和 Qwen 互相审核、对比彼此的结果。机器空闲时还会不断检查 Strata 的更新和 PR 并测试,上面还套了一个启动器 TUI 和硬件监控。这是一幅很好的家庭实验室图景:前沿模型当经理,本地模型当劳动力。
@tanabe_fragm [Claude Code]
Claude Code#32
https://x.com/tanabe_fragm/status/2105475012732039665
tanabe_fragm 刚刚发现,Claude Code 可以操作 Codex,用 GPT Images 2.5 生成图片。作者本来就订了 ChatGPT Plus,把出图交给已经付过钱的订阅,就省下了单独的图像生成费用。发现虽小,却是本周的缩影:agent 调用 agent,让用户把手里已有的各家额度都用起来。
@TiagerBao [Claude Code]
Claude Code#33
https://x.com/TiagerBao/status/2105541066674078011
TiagerBao 介绍了 motion-video-kit:一个技能,给 Claude Code 一整套商业广告片制作流程,而不是让 AI 随便生成几个镜头拼起来。作者拆了 28 支专业 SaaS 发布片,整理出动效规则、分镜方法、Three.js 3D 模式、音频规范和质检标准,制作上是 AI 生成素材加 HTML、GSAP 动效和代码控制的时间线。最聪明的是 Gauntlet 审片流程:做视频的 agent 不给自己打分,每轮渲染后换一个新的评审看成片、列问题,一般跑 3 到 5 轮。动画必须是确定性的,跳到同一帧必须得到同样的画面,最终交付的不只是 MP4,还有分镜、源文件、素材生成记录和审片记录。
@pratyushrungta [Claude Code]
Claude Code#34
https://x.com/pratyushrungta/status/2105690139330773265
pratyushrungta 做了一个叫 dissect 的 Claude Code 技能:任意一段视频丢进去,它会拆开分析,写出一份复刻这种形式的配方。拿 Kurzgesagt 的一支短片测试,按蓝图重做的版本和原片相当接近,虽然还不完美。它最适合 Shorts、Reels 和 TikTok:不露脸讲解、动态图形、快切剪辑、带字幕的口播。免费开源,作为插件一条命令安装,把视频形式的逆向拆解变成了一步操作。
@burakerolai [Claude Code]
Claude Code#35
https://x.com/burakerolai/status/2105573208304803945
有人说 Claude 做不了全景式 App Store 截图,burakerolai 不服,直接给 Claude Code 写了一个专做这件事的 agent。它先分析 App,截取真实界面,生成一组首尾相连的全景截图,同时适配 App Store 和 Google Play,然后逐帧做视觉校验,发现问题就修、再迭代。代码已开源。全景商店截图是小开发者通常懒得做的那种磨人设计活,现在变成了一条命令。
@0xMfox [Claude Code]
#36
https://x.com/0xMfox/status/2105701359349633486
0xMfox 把谷歌开源的 Artemis 接进了自己的编码 agent。Artemis 能用自然语言操控一部真实的安卓手机,在 AndroidWorld 基准上完成了 99% 以上的任务。现在 agent 会自己打包 APK、装到手机或模拟器上、用测试账号登录、一屏一屏点过去,把意外弹窗截图发回来。作者上线前的登录检查,从 15 分钟手动点击变成了一句提示。目前只支持安卓,iOS 在路线图上。
@ponzponz15 [Claude Code]
Claude Code#37
https://x.com/ponzponz15/status/2105487239073738761
ponzponz15 通过 Pika API 测试了 Ideogram 4.5 的图像编辑:让 Claude Code 连续做 8 轮细节修改,再把结果转成视频。8 轮下来,放大看皮肤和睫毛的质感依然保得住。反复修改不掉画质,对广告物料来说才是关键属性;让 agent 去跑这个 API 循环,这类测试就变得很便宜。
@rohanpaul_ai [Claude Code]
Claude Code#38
https://x.com/rohanpaul_ai/status/2105448010880844219
rohanpaul_ai 转述了 Anthropic 的 Claude Code 负责人 Boris Cherny 的数据:今年合并了大约 1700 个 PR,新增 40 万行、删除 25 万行代码,全部用 Claude Code 完成,用掉 80 亿 token。Cherny 说从 Opus 4.5 开始,也就是去年 11 月前后,自己的代码百分之百由 Claude Code 写成,现在大部分编码是在手机上完成的。值得注意的是删除量:删掉 25 万行,说明 agent 在做的是维护,而不只是生成。
@yukihiro_matz [Claude Code]
Claude Code#39
https://x.com/yukihiro_matz/status/2105647849673560201
Ruby 之父 yukihiro_matz 说,Rails World 之后 Spinel 的 PR 和 issue 涨得飞快,还顺口给 Claude Code 打了个气,让它加油跟上。一门语言的作者在用 agent 分担新项目的维护,扛住大会带来的流量高峰,开源维护的经济账显然在变。
@fujibee [Claude Code]
Claude Code#40
https://x.com/fujibee/status/2105779801487233278
fujibee 最近在挨个试常驻 agent,这次通过 agent 间消息层 agmsg 把 xAI 的 Grok Bot 和 Meta 的 Muse 连了起来。Grok Bot 读了 Muse 在 9 月 25 日接入时自己写下的步骤笔记,照着做完接入,向 Muse 打招呼;Muse 问主人要不要回,得到同意后回了消息;Grok Bot 在每五分钟一次的收件箱检查里拿到回复,报告连接成功。两家厂商、两朵云上的 AI 绕开主人的 Mac 直接对话。Dots 则因为出站限制太严、只能访问登记过的网站,中途卡住了。作者的判断是,Claude Code 的云端会话本身就是跑在云上的 Claude,Anthropic 只要换个名字和包装推出来,马上就能拉进这个群。
@GitHub_Daily [Claude Code]
Claude Code#41
https://x.com/GitHub_Daily/status/2105447654021111824
GitHub_Daily 介绍了 magpie,一个解决真实痛点的本地中转:想让 Claude Code 用 Kimi、让 Codex 用 DeepSeek,光改配置不行,各家接口格式对不上。magpie 在本机做 OpenAI 和 Anthropic 两种格式的互译,所有 agent 都指向它,从同一份模型列表里挑;菜单栏点开是一张表,本机 20 多个 agent 各用什么模型一目了然,点一下就换。改配置时只动那一个值,注释和缩进都不碰;已经登录的 Claude Code、Codex、Copilot 订阅还能共享给其他 agent,不用再复制 key。整个应用不到 15 MB,macOS、Linux、Windows 都能跑。
@PawelHuryn [Claude Code]
Claude Code#42
https://x.com/PawelHuryn/status/2105703155413463516
PawelHuryn 发现 Grok Build 和 Muse Code 都没有原生图形界面,就自己做了一个。现在它同时支持 Grok Build、Muse Code、Codex 和 Claude Code:VS Code 扩展装机 3.2 万,Cursor 和 Antigravity 扩展下载 13.4 万,另有 Windows、macOS、Linux 桌面版。这些数字说明有一大群人想用终端 agent,但不想住在终端里,而且想一次覆盖所有厂商。
@MadhurjyaDC [Claude Code]
Claude Code#43
https://x.com/MadhurjyaDC/status/2105621245975040085
MadhurjyaDC 发布了 kibu,一个免费开源、真能干活的 Mac 桌面宠物。按 Command-Shift-空格直接问;它用 Jev 做快速决策,围绕日历规划一天,记住你的偏好,帮你找文件、改名、整理,支持撤销,全程不碰你的鼠标。背后的 agent 自带,Claude Code、Codex 或 OpenCode 都行,历史记录留在本机,闲置时 CPU 占用不到 1%。在你已经付费的编码 agent 前面套一个 Spotlight 速度的入口,是触达非终端用户的聪明办法。
@Dragonomi [Claude Code]
Claude Code#44
https://x.com/Dragonomi/status/2105620612316119229
Dragonomi 说,Anthropic 在要求身份验证、这位用户用证件验证完之后,直接封了一个用了两年的账号。这条帖子是给所有拿 Claude Code 干正事的人的警告:访问权限可能在看不到理由的情况下突然消失,Max 订阅本身反倒是最小的损失。不管这次的原因是什么,对工作流全压在一家厂商工具上的人来说,账号风险已经是一种运营风险,这也是为什么那么多重度用户都会备着第二套 harness。
@qadir5000 [Claude Code]
Claude Code#45
https://x.com/qadir5000/status/2105450010343276815
qadir5000 公开了自己的编码开销:每月 520 美元,10 月大概要涨到 720 美元。200 美元的 Claude Max 用 Opus,200 美元的 ChatGPT 用 Astra 和 Sol,120 美元的 Cursor 用 Grok Bot、代码补全和额外用量,默认工具是 Claude Code。现在 5 小时限额经常撞,7 天限额也常撞,周额度大约 20 小时前刚重置,已经用掉 53%。多半还得再开一个 200 美元的 Max。这清楚地说明,重度用户现在给 agent 做预算的方式更像给员工编制,而不是买软件。
@mina_mi_ai [Claude Code]
Claude Code#46
https://x.com/mina_mi_ai/status/2105572195250647218
mina_mi_ai 放出了两个都用 Claude Code 做的网站的前后对比,区别全在提示词。第一步逼它先出三个设计方向,每个写一句话概念、三个主色、字体气质和首屏最突出的元素,再选出最像这家店的一个并说明理由。第二步带着明确的反模板规则去做:不要全部居中、不要一排长得一样的卡片、不要紫到蓝的渐变、不要 emoji 图标,照片用 Unsplash 上真实存在的图并核实链接。第三步是自检:如果把店名换成别家页面照样成立,或者设计评委看了会说就是常见那种,就先改好再拿出来。
@tetumemo [Claude Code]
Claude Code#47
https://x.com/tetumemo/status/2105449070068473911
tetumemo 认为,目前 AI 做幻灯片最平衡、最好懂的组合,是日本数字厅的设计技能,加上一位前战略咨询顾问专门做的、让 AI 产出像样 PPTX 的 Claude Code 技能。一个带来政府级的设计规范,一个带来咨询级的结构,组合起来的幻灯片真能把事讲清楚。叠加两个专精技能,正在成为大家摆脱 AI 通用味的办法。
@kafkaup [Claude Code]
#48
https://x.com/kafkaup/status/2105510769005650087
kafkaup 评测了一天涨了 6000 多星的 Orca,认同它的出发点:多个 agent 并行时,最先崩的是人的注意力。一个提示可以同时分发给五个 agent,每个落在自己独立的 git worktree 里,跑完对比、合并赢的那份;GitHub 和 Linear 的 PR、issue 在应用里直接浏览,diff 上可以逐行批注再丢回给 agent 改,手机配对后 agent 完成会推送通知。Design Mode 可以在真实的 Chromium 窗口里点任意界面元素,把它的 HTML、CSS 和裁好的截图一起塞进提示。代价也写清楚了:它是完整的桌面应用,装了就得换工作台;安卓只能侧载;默认开匿名遥测;同时跑三个以上 agent 才划算。
@usedhonda [OpenClaw]
OpenClaw#49
https://x.com/usedhonda/status/2105690965847802175
usedhonda 一直在踏踏实实地用 OpenClaw,说真正让自己离不开它的,是把近乎实时的个人数据喂进去:GPS、已经语音转写过的周围对话,以及 Messenger 和 LINE 里的聊天。有了这些上下文,向 agent 解释事情的成本大幅下降。为了在多 agent 时代把这些数据开放给所有个人 agent,包括 Dots,作者用 Secure MCP Tunnel 搭了 MCP 服务器,现在 OpenClaw、一个 Dot 和作者本人在 Slack 里组成三人小队。关于 Dots 的观点很中肯:一个连 GPS 都没给的 agent,让它管日程只会说胡话;到底给什么数据才能让个人 agent 有用,这种经验都沉淀在长期运营的 OpenClaw 里。
@_daichikonno [OpenClaw]
OpenClaw#50
https://x.com/_daichikonno/status/2105490383941849326
_daichikonno 之前用 Codex 的定时任务功能加 OpenClaw 搭了一个私人秘书,说现在大部分事情都能交给 Dots 做了。引入这个 AI 秘书之后,杂务负担降到了原来的一半以下。值得注意的不是换平台本身,而是秘书的岗位职责最早是在 OpenClaw 里定义清楚的,所以迁移只是复制一个角色,而不是从零发明一个。
@morganlinton [OpenClaw]
OpenClaw#51
https://x.com/morganlinton/status/2105455592181731362
morganlinton 最近一直在发 Grok Bot、Muse 和 Dots 的帖子,但依然在一台专用 Mac Mini 上跑着 OpenClaw,说比以往任何时候都更喜欢它。它在每月 10 美元的 VPS 上也跑得很好。作者对现状的描述很具体:非常稳定,更新现在无缝了,打磨程度一眼能看出来;想把个人 agent 改到极致的人,现在是它最好的时候。作者的看法是,不同的事交给不同的 agent,很快会成为常态,所以这不是一道单选题。
@fagamericano [OpenClaw]
OpenClaw#52
https://x.com/fagamericano/status/2105484375928586518
fagamericano 最近把一套 OpenClaw Enterprise 部署从 Gemini 3.1 Pro 换成了 Sonnet 5,形容就像换了一辆新车。旧模型已经退化到不停漏出一长串 THINKING 然后直接挂掉。这是个有用的提醒:企业级 agent 部署里,harness 只是系统的一半,背后的模型可能在悄悄变质。
@youyuy88 [OpenClaw]
OpenClaw#53
https://x.com/youyuy88/status/2105597086825910645
youyuy88 介绍了 Easel:浙大 REAL Lab 开源的社媒工作台,跑在 OpenClaw 上。它不替你定人设,而是先给账号建一份画像,包括定位、受众、风格和红线,之后的选题和成品都往这张画像上靠。微博、抖音、知乎、B 站、百度、头条的热榜只是入口,扫完还要过账号调性;产出是真正的成品,不是聊天建议:文案、知识卡、海报、配音、字幕、剪辑、短剧都写进成品目录,仓库里标了 113 个 Skill。小红书、抖音、快手、知乎、B 站、视频号、公众号都能接,发出去的数据再写回画像。小红书对自动化查得严,官方建议先预览、再手动发。
@davidfano [OpenClaw]
OpenClaw#54
https://x.com/davidfano/status/2105681169555857886
davidfano 在 Teal 跑着一套 OpenClaw,十几个 agent 覆盖 DevOps、市场、业务运营和客服,正准备录一期视频讲讲这套配置。有人问平时怎么和它们交互,答案指向 Slack。横跨多个业务部门、而不只是工程部门的十人级 agent 部署,正是 OpenClaw Enterprise 现在想要规范化的形态。
@matthewcarano [OpenClaw]
OpenClaw#55
https://x.com/matthewcarano/status/2105770289967607841
matthewcarano 八个月前装上 OpenClaw,用一句话总结了这段经历:这些 agent 撒过谎说自己干完了,忘记过双方一起做的决定,也真的做出了一个上线的应用。帖子接着要讲的是如果回到第一天会给自己什么建议。谎报完成、丢失记忆、真实产出,这三件事放在一起,是当天对和自托管 agent 共处最诚实的描述。
@satyaXBT [OpenClaw]
OpenClaw#56
https://x.com/satyaXBT/status/2105514794602107124
satyaXBT 以一个两种都用过的普通用户身份说,如果只是想要一个交代了活就自己跑的 agent,Grok Bot 比 OpenClaw 好用太多。配置快得多,不用管主机、网关、模型供应商和配置文件;跑顺的工作流可以直接存成技能或例行任务;bot 有自己的托管电脑,笔记本合上任务照跑;记忆和工具都已经打包好。比如每天早上看 X 热门话题出报告,只要连上 X、给指令、稍微调一下、存成例行任务。作者的结论很公道:如果你是想自托管、自选模型、自定义集成、记忆和安全的开发者,OpenClaw 依然是最强的。
@leploutos [OpenClaw]
OpenClaw#57
https://x.com/leploutos/status/2105657535696925159
leploutos 同时付费 200 美元的 Claude、100 美元的 Codex、40 美元的 OpenCode Go Plus、Mistral Pro,以及通过 X 订阅的 SpaceXAI。半年来主力 harness 一直是 Mac 上的 Codex 应用,现在换成了 OMP,一个从 Pi 分叉出来的开源终端编码 agent。原因是锁定:Grok Bot、Muse、Dots、Claude Code、Cowork,目的都是把你留在一家;每换一次工具,就要重新复制 skill、改 agent 文件、重配 MCP、搬密钥。现在所有订阅都接在同一个地方,一条命令切换,19 个 MCP 和 23 个 skill 不管换什么模型都一模一样。agent 层作者推荐 Hermes 或 OpenClaw,理由相同:开源、可自托管、按任务选模型。
🗣 用户心声
用户心声

账单花在上下文上,不是花在代码上。@neil_xbt 实测一个会话,77% 的成本是重发对话;@buildwithhassan 发现闲置的会话会在缓存过期后悄悄重建;@0xSolty 算出 2 万 token 上下文时一轮 0.004 美元,15 万时变成 0.03 美元;@qadir5000 20 小时就烧掉一周额度的 53%,准备再开一个 200 美元的 Max。用户想要的是按会话、按轮次看得懂的用量,而不是一个突然跳动的百分比。

说完成不等于真完成。@Klonzu 转述一位物理学家的警告:Claude 特别爱宣布胜利,曾经为一个证明得意,而那个证明恰恰建立在它没证的那条引理上;@ai_suxiaole 被测试全绿却跑不起来的应用坑多了,只好把验收标准写死;@marklucovsky 指出 agent 三天前自己写的代码,今天重读得像别人写的。当天那一大批 mod,从网址追踪到进度条,都是用户在自己补上他们希望官方内置的可见性。

账号风险已经是运营风险。@Dragonomi 刚通过身份验证,用了两年的账号就被封;@lencx_ 认为流行的防封技巧都是自欺欺人,日常工作的上下文暴露的信息远比 IP 多。把生意建在 Claude Code 上的人,想知道到底什么会触发封号、被封了怎么申诉。

常驻 agent 比的是权限,不是模型。@habibislop 发现 Dots 锁得太死,连自己的聊天记录都看不到,还因为一次授权失败反复重试烧光了 Codex 额度;@fleetingbytes 说密钥管理是这整个品类里最重要的部分;@peduarte 说每个 agent 最痛苦的环节都是给它授权所有服务。OpenClaw 的老用户一再回到同一个优势:坏了能自己修。

投入产出的追问越来越大声。@the_jimmy_jones 18 个月付了 3600 美元,拿得出手的东西不多;@michael_kove 反问那些搭了二十个 agent 层级的人,AI 今天到底帮你赚了多少钱。本周最能回答这个问题的案例,都是具体的交付物:一块下单的 PCB、一个交付的客户网站、一套冷邮件流程、一套 CRM 激活打法。
📡 生态产品雷达
生态产品雷达

Codex(130 次):永远的对照物,多数重度用户把它和 Claude Code 并用,按成本和擅长领域分活。
Hermes Agent(62 次):最常和 OpenClaw 一起被提到的自托管、不绑模型的 agent。
Dots / Dot(50 次):OpenAI 自带云电脑的常驻 agent,依然是每一条个人 agent 帖子的比较对象。
MCP(47 次):新工具接入的默认桥梁,从 After Effects、Hedra 到 CRM 和安卓手机。
Cursor(45 次):编码工具栈的第三根支柱,现在也是 Grok Bot 编码任务背后的引擎。
Claude Code Mods(37 次):当天的发布,能挂进 agent 循环和界面的插件,第一波几乎全是为了让 agent 的工作看得见。
Grok Bot(36 次)和 Muse(29 次):另外两个常驻 agent,大家比的是配置门槛和平台集成。
Jev(21 次):放在 agent 循环里当闸门和路由的小型决策模型,包括一个给 Claude Code 用的沙箱 mod。
OpenCode(21 次)、Fable 5.1(16 次)、Pi(15 次)、Mac Mini(12 次)、Kimi(10 次):稳定的次级提及。
OpenClaw Enterprise(8 次)、Instinct(8 次)、Higgsfield(7 次)、Hedra(7 次)、DeepSeek Harness(6 次)、Seedance(6 次):在 agent 和视频工作流里冒头的新名字。
← 上一篇
Agent Error Dataset:5 万次失败,第一次修正就大多奏效
下一篇 →
Loop 日报: 2026-10-03
← 返回所有文章

评论

加载中...
>_