2026年8月16日super-user

超级用户日报: 2026年8月16日

昨天这个生态第一次不再是单一厂商的故事。DeepSeek 开源了一个"万物皆插件"的 harness,一天之内社区就给它做出了 TUI、Telegram 桥接和 365 个插件;Qwen3.8-27B 上了 Ollama,一个参数就能塞进 Claude Code 里跑。热闹底下,真实用法还在继续往代码之外漂:牙医那 800 个 DICOM 文件被做成了查看器,医疗设备的传感器日志被做成了本地看板,一部小说排好了每天中午的连载,一个为尼日利亚移动网络体量而生的 3D 公民教育网站,还有一台跑在 Mac mini 上、会复现 bug 并直接提 PR 的客服台。剩下的半天,大家都在算账:一次会话到底花多少钱,一个套餐到底值多少钱,以及当 agent 悄悄替你做了个决定之后会发生什么。
@redp314 [Claude Code]
Claude Code#1
https://x.com/redp314/status/2088206627954405400
根管治疗前牙医拍了 3D X 光,并告诉他原始数据没有专业软件打不开。那是 800 个 DICOM 文件。他把 Claude Code 指向那个文件夹,让它做个查看器。两个 prompt 之后他就有了一个——按他自己的说法,比牙医在诊所屏幕上给他看的那个还好看。现在有意思的非编码案例大多是这个形状:不是"给我写个 app",而是"这个文件格式是堵墙,帮我翻过去"。
@venelinkochev [Claude Code]
Claude Code#2
https://x.com/venelinkochev/status/2088219494384554480
他把 Crisp 拆了,自己做了个客服聊天直接接进后台管理界面,然后把这个聊天接上了自己的代码库。Mac mini 上一个小 worker 监听新工单,每来一条就拉起 Claude Code,对着一个与线上保持同步的本地仓库去查。如果是提问,agent 会自己搞清楚产品到底怎么运作,然后起草一份回复。如果是 bug,它会尝试复现;确认之后他点一个按钮,agent 就改代码、跑测试、推 GitHub、开 PR,他只需要 review 然后合并。目前已经真实处理了十几个客户工单。
@camale0nrar0 [Claude Code]
Claude Code#3
https://x.com/camale0nrar0/status/2088308253167956434
让医疗软件厂商交出原始数据是一场打不赢的仗,于是他不问了,直接把 Claude Code 指向未压缩的导出文件。一个晚上,一堆乱七八糟的传感器日志变成了本地看板,替掉了要花好几千块的专有界面。他最后那个问题才是现在没人答得好的:这种为了一次性任务写出来的本地小工具,你到底是留着还是扔掉?
@vortexau [Claude Code]
Claude Code#4
https://x.com/vortexau/status/2088394424221065648
从开始做漏洞赏金那天起他就想要一条扎实的自动化信息收集流水线,六年多过去,除了几个基础脚本一直没真做成。Claude Code 把这个缺口补上了。有意思的不是 agent 帮他写了几段脚本,而是一个"总有一天要好好自动化"的六年积压,在写胶水代码的成本降到接近零之后一次性塌掉了。安全信息收集恰好就是最吃这一口的活:工具多、格式杂、没有任何一家厂商能覆盖整条链。
@moyomadee7 [Claude Code]
Claude Code#5
https://x.com/moyomadee7/status/2088335634460979314
他用 three.js、react-three-fiber 加 Claude Code 里的 Opus 5,做了一个叫 Three Arms 的交互式 3D 网站,讲尼日利亚联邦政府怎么运作。他没有用图生 3D 的管线,而是让每个地标都用代码直接写几何体,把整个应用控制在了 2.2MB 左右。这个约束才是重点:一个为尼日利亚做的学习工具,不该要求你有快网和大流量包。里面有一段议案在国会两院之间流转、最后走完协调程序成为法律的动画,你也可以点进每个机构的各个部分,直接在 3D 模型上看到讲解。
@marekl [Claude Code]
Claude Code#6
https://x.com/marekl/status/2088171260807180755
Seznam 地图开始在桌面端测试矢量格式,往浏览器传的不再是位图而是分离的数据图层。他用 Claude Code 破解了那些二进制源文件——他说这才是真正的难点——现在能拿原始图层生成自己想要的地图画作。这是一年前几乎不存在的一类事:把逆向一个无文档的二进制格式当成周末消遣。
@dan__rosenthal [Claude Code]
#7
https://x.com/dan__rosenthal/status/2088264456014909519
他们整个公司的大脑就是一个装满 markdown 的 GitHub 仓库,结构他打磨了半年。根目录放 CLAUDE.md 承载上下文和高层指令,INDEX.md 是内容目录让 Claude 快速定位文件,.mcp.json 让每个同事零配置拿到 15+ 个 MCP。.claude 目录拆成 skills(一个技能干一件事,三十多个)、agents、把技能串起来的 commands、每次会话都跑的输出检查 hooks,以及根据当前打开文件改变行为的 rules。wiki 部分是 company、marketing、automations、services 四个文件夹,会议记录和文档作为输入层,另外每个客户单独开一个仓库。
@0xSero [Claude Code]
Claude Code#8
https://x.com/0xSero/status/2088316409289888139
他让每个 agent 通过 tmux 去咨询其他所有 agent:Pi 里跑 Kimi-K3,omp 里跑 GLM-5.3,Codex 里跑 GPT-5.6-Sol,Claude Code 里跑 Fable 5 / Opus 5。他的反馈是现在能蒙混过关的垃圾少多了——因为让一个模型审自己设计的架构就是回音室,换一家厂商的模型就不是。他还提到一个没人规划过的副作用:这套安排顺便生成了多得多的、可以拿去训练的对话记录。
@traderwanwan [Claude Code]
Claude Code#9
https://x.com/traderwanwan/status/2088130023043764380
同一个思路,机制更干净。他用终端工作区管理器 herdr,让一个 Codex agent 当主力开发,一个 Claude Code agent 当 reviewer。他告诉开发 agent:写完把分支或 worktree 交给 review agent,等对方真的评完再把结果读回来,然后你自己独立判断要不要改。herdr 跟别的工具不同的地方非常窄:它不取代你的终端,也不管理你的上下文,只把"跨厂牌的两个 agent 能互相呼叫、并且能等对方"这一件事做好。
@doooyle [Claude Code]
Claude Code#10
https://x.com/doooyle/status/2088269511862464646
他日常工作大部分跑在 Claude Code CLI 上,Mac mini 上挂着若干 loop,负责查收和回复冷邮件、盯站点数据并推送微调,代码要么进 Render 服务器要么回到 mini 上的 loop。他花了一天试着把这套搬到 Grok Bot,写出了当天最清楚的一份失败报告:它改 agent 代码时的原生做法是通过 Cursor cloud 开 PR;带 API key 抓数据这一步它挂了而 Claude Code 能过;它只挖到"一两条消息能装下"的深度就停;而且它坚持要当参谋长,不肯当那个"既干活又向参谋长汇报"的人。他真正需要的是一个真正的 CLI worker,加一个带 cron 或 watcher 的真正云端 worker,这样本地机器不必一直醒着。
@sugaroverflow [OpenClaw]
OpenClaw#11
https://x.com/sugaroverflow/status/2088220729581940830
少见又有用:跑 agent 集群的真实配置数字。她是因为 OpenClaw 才开始搞 VPS 的,想让 agent 跟笔记本隔离;起步一般是 4 核 16G,她自己说这偏保守。等到六个以上的 agent 同时在做浏览器调研、爬虫、克隆大仓库、下载模型文件、搬运生成的图片视频时,她会升到 8 核 32G,某些离谱实验甚至上 64G。她现在在考虑把负载拆到多台 VPS 上,而不是继续堆一台巨型 agent 机——主要因为 agent 的忙闲是一阵一阵的,不是连续的。
@iamsupersocks [OpenClaw]
OpenClaw#12
https://x.com/iamsupersocks/status/2088187392385548358
他走的是反方向,读起来更像成熟版。他曾经有十几个 agent,最后只留了一个。OpenClaw 在他那儿一天到晚崩,于是他转到了 Hermes。现在他只跑一个配置好的 agent,配一个 .md 和一个 Obsidian 库当长期记忆,自动化以 cron 的形式加上去,在 Hermes 面板里统一监督。真正的洞见是那条"毕业路径":一个工作流跑通之后,他会逐步把它从 agent 里拿出来——先在 Obsidian 里写成文档,再变成 skill,最后变成一个纯 Python 脚本。此后 agent 只负责确认脚本还在正常跑,坏了才介入。
@dashen_wang [OpenClaw]
OpenClaw#13
https://x.com/dashen_wang/status/2088262243922366530
他的判断是:AI 小玩家的终局不是装一堆 agent,而是先给自己搭一个小型控制平面。模型层用 CC Switch 或 LiteLLM 统一管 Claude、Codex、Kimi、MiniMax、Qwen 和本地模型。MCP 统一放一起,Skill 统一放一起,Prompt 统一管理,API Key 和 Token 别到处乱塞。Hermes、OpenClaw、Codex 这些就只是干活的:任务来了,控制平面决定用哪个 agent、哪个模型、挂哪些 MCP、加载哪些 skill,再把凭据临时给它,跑完记录效果,慢慢把路由调顺。以前玩模型,后来玩 agent,再往后玩的其实是这整套基础设施。
@CloisterRes [OpenClaw]
OpenClaw#14
https://x.com/CloisterRes/status/2088389923791348192
当天最好笑也最诚实的工作流。他写了个程序扫描新的 EDGAR 备案文件,喂给一个 API 判断是否重大,重大的就发到自己邮箱。他会读吗?不会——他让 OpenClaw 去看那封邮件摘要,再写一份更短的。那份他读吗?也不读——他把它再送回 API,让它总结自己 OpenClaw 的分析,然后他读这一份。一条链上压缩了四层,人类只读最后那一寸。
@woraperth [OpenClaw]
OpenClaw#15
https://x.com/woraperth/status/2088406317820248535
一个新手对"有个助理到底是什么感觉"的记录。OpenClaw 和 Hermes 他看了挺久,但他讨厌折腾配置,尤其是要自己管的 VPS,同时又怕 token 账单没有上限。后来他找到一家按包月计价、额度每五小时重置的托管服务,两个顾虑一起消掉了,现在通过 Discord 跟这个 agent 说话。目前的用法:让它从 GitHub 读他的 second brain,好知道他在做什么;每天早上读他的日历,汇总当天有什么,并从 second brain 里把每件事相关的上下文一起拉出来。他对这段关系的描述最准确——得教它、看结果、不断纠正,像带小孩,但是个聪明小孩。
@hrudolph [OpenClaw]
OpenClaw#16
https://x.com/hrudolph/status/2088397206063915271
三行字,却是消费级 agent 使用现状的一张不错的快照。一天之内他的 OpenClaw 从必胜客点了晚饭、看了他的 Slack 消息、在 Discord 上封了一个刷屏的人。不是工作流,不是框架,就是一个能在三个毫不相干的界面上替他跑腿、而他一个都不用打开的东西。
@lucasradaelli [OpenClaw]
OpenClaw#17
https://x.com/lucasradaelli/status/2088316077050859844
一个体量很小但品味很好的自动化。他的 OpenClaw 盯着楼里的包裹到达通知,如果有包裹到了、而他还没查邮件,就提醒他回家路上顺便去前台拿一下。有意思的是那个触发条件:它踩的是"现实事件"和"他自己没注意到"这两件事的交集——这恰恰是规则引擎很难表达、而 agent 很容易表达的东西。
@azolkipli [OpenClaw]
OpenClaw#18
https://x.com/azolkipli/status/2088088428676301143
他架了个 IoT 摄像头,每天给自己的 OpenClaw 服务喂一张图,让它检查植物并汇报状态。他很坦白,准确度一般,但对日常照料还是有帮助的。目前已经结了四个果。家用 agent 的"值不值"门槛比工程场景低得多,因为它的替代品不是一个更差的工具,而是根本没人看。
@chrismatthieu [OpenClaw]
OpenClaw#19
https://x.com/chrismatthieu/status/2088354569847968130
他给 AgenticROS 做了个新 skill 叫 JARVIS,可以通过麦克风和喇叭跟 ROS 机器人对话,拿回来的既有 LLM 的回答,也有真实的机器人动作和技能。演示里他问机器人看到了什么,RealSense 的快照被喂进 OpenClaw,然后由它作答。他说 v0.1.1 已经能跑,下一个明显要解决的问题是速度——这正好是下一个案例撞上的那堵墙,而且人家还带了数字。
@murasametech [OpenClaw]
OpenClaw#20
https://x.com/murasametech/status/2088254847145640163
昨天全网最有用的一份性能剖析。他那套 Stack-chan 是语音识别、本地 LLM 推理、再用合成语音说出来,一次应答大约 57.3 秒。他把耗时拆开了:GPU 被调用之前就花掉 49.3 秒(86%),RTX 5060 Ti 上 Gemma 4 的真实推理只有约 1.5 秒(2.6%),GPU 返回之后处理 4.1 秒,语音合成、Wi-Fi 传输和播放 2.5 秒。本地 GPU 推理根本不是瓶颈——OpenClaw 里那个 GPT-5.6 agent 决定去调本地工具、再处理返回结果,占了全程 93%。他的解法是只给语音这条路径开一条专用通道,绕过 agent 往返直接调本地推理,目标是热状态下 4 到 7 秒。
@yu_ichi_suzuki [Claude Code]
Claude Code#21
https://x.com/yu_ichi_suzuki/status/2088074910556160095
他在 RTX 5090 上试了本地音乐生成模型 MiniMax-Music3。prompt 写得薄,出来的东西就薄;官方 demo 的 prompt 一首歌大概要 600 到 800 个词,这不是人手写的量级。官方 GitHub 里附了一个 music-caption-rewriter 的 skill,专门把短 prompt 展开成那种格式,他就让 Claude Code 读这个 skill 帮他写。然后他放了个 A/B:同样的歌词同样的种子,一版用 Suno 风格的短 prompt,一版用展开后的官方格式,另外还附了 Suno v4.5 和 v5.5 做参照。日语演唱相当扎实,本地版目前还没有 Suno 那种 Cover 和 Extend,生成时间大致等于曲子本身的时长。
@koizuka [Claude Code]
Claude Code#22
https://x.com/koizuka/status/2088200539494596978
他一直在业余研究用 Claude Code 写小说,终于觉得像样了,于是把新的九话作品排好了从明天开始每天中午在"成为小说家吧"上连载。他对进步的描述很有创作者的诚实:上一部作品光是把它做成个完整的形状就已经用尽全力了,这一次的目标是让它真的好看。这跟通常那种"AI 写了本书"的说法完全是两个难度。
@alwayspriyesh [Claude Code]
Claude Code#23
https://x.com/alwayspriyesh/status/2088245245075194037
暑假里一个九岁女孩和她朋友在笔记本上写下了一个游戏点子:一个西瓜王国、一颗柠檬、还有一支想毁掉王国的细菌大军。她爸爸让 Claude Code 处理了游戏机制、敌人、碰撞、动画和胜负判定,还把她们原来的手绘变成了 3D 模型。让这件事成为一个真案例而不只是一件可爱的事的,是那个循环:女儿不停地测试并给反馈——"细菌太慢了"——他转达,Claude 改,她再测,反复到手感对为止。
@gusoku_ai [Claude Code]
Claude Code#24
https://x.com/gusoku_ai/status/2088231672131322207
他下午一点开始,现在快晚上九点了,却不太觉得累,因为他这一整天干的其实就是复制粘贴。Genspark 说"把这个发过去",他粘进 Claude Code;结果再粘回 Genspark,Genspark 又说"下一条这个",无穷无尽。到某个时刻这已经不像在工作,而像在看两个 AI 自己聊天,他只是中间那个搬运工。这是当下全世界最常见、也最不体面的多 agent 配置,而几乎没人把它写下来。
@kensuu [Claude Code]
Claude Code#25
https://x.com/kensuu/status/2088102833250029805
他这条是对整个"更快出货"叙事的纠偏。正因为 AI 把开发速度拉到离谱,现在的失败模式变成了每冒出一个念头就立刻实现。所以他让 Claude Code 每次都对点子做严格打分,跟其他待办任务放在一起权衡,告诉他到底该先做什么、还有什么没考虑到。他把这叫做"把 AI 用在不做的决策上,而不是做的决策上",并且说这可能是他整套配置里最有价值的一环。
@kotetsu_0321 [Claude Code]
Claude Code#26
https://x.com/kotetsu_0321/status/2088188889974673428
一旦你同时跑很多会话,丢掉的不是代码质量,而是"哪个在跑、哪个在等我、哪个已经完事"这份感知。他用一个 prompt 给 Claude Code 加了个看板,按"下一步轮到谁"来排列会话。他后来单独公布了完整 prompt,而那份设计说明比功能本身更值得看:列是按"轮到谁"分而不是按进度分;状态从对话内容判断而不是从会话名判断,因为名字是后加的、会跟实际漂移;而且它只读应用本地已有的数据,不发任何外部请求。
@ClaudeCode_UT [Claude Code]
#27
https://x.com/ClaudeCode_UT/status/2088188923189285116
一条真正承重、却没多少人知道的运维知识:长会话自动 compact 的时候,有些东西会回来,有些不会。CLAUDE.md 和 auto memory 会从磁盘重新读入所以能活下来;但子文件夹里的 CLAUDE.md、或者限定 path 的规则,会一直消失到你再次打开对应文件为止。也就是说,你把一条指令放在哪里,决定了它能不能扛过压缩。长会话跑到中途指令突然不生效了,第一个该怀疑的是子目录文件或 paths frontmatter,而不是模型。
@ClaudeCode_UT [Claude Code]
Claude Code#28
https://x.com/ClaudeCode_UT/status/2088071867240525960
姊妹篇,讲的是 Claude Code 为什么会突然变慢、或者某一轮突然特别贵。大多数时候是你自己做的某个操作——切模型、compact——把整个缓存打碎了,然后触发了重建。改了 CLAUDE.md 却对当前会话不生效,属于同一类行为。最尖锐的一条细节:在长会话中途第一次打开 Fast mode,会导致那一轮把整段对话历史重读一遍,所以在会话开始时就定下来要便宜得多。结论是结构性的:你越是在不懂缓存机制的情况下频繁切模型和 effort,越是在看不见的地方同时损失速度和钱。
@jordanurbs [Claude Code]
Claude Code#29
https://x.com/jordanurbs/status/2088402064489451948
他退掉了 Claude Code 订阅,并且给自己定了 30 天,期间连"要不要回去"都不考虑,理由有三条。第一,被补贴的推理不会永远便宜下去,他不想等另一只鞋落地的时候已经完全依赖。第二,他更喜欢用 Kimi,觉得 K3 在大任务上跟 Opus 4.8 甚至 Fable 5 一个水平,但更好懂,通过 Venice 走还更便宜更私密,简单活配 DeepSeek V4 Flash。第三,他在有意"少工作"——手上没那么多推理可以随便挥霍之后,他反而被推回去用自己的脑子做内容。两天下来他形容这像断食:很难受,很饿,但他知道对自己好。同一天早些时候那条是具体版本——改成按请求付费之后,没有一个字是没被注意过的,他也才意识到 context 和工作区文档到底有多重要。
@mikereining [Claude Code]
Claude Code#30
https://x.com/mikereining/status/2088411184756383964
他每月跑掉大约 1500 美元的 AI 编码工作量,实际账单大约 200 美元。他的论点是:重度使用还按原始 token API 价付费,等于交 5 到 10 倍的税;而把厂商订阅档位跑满,相当于在标价上打了 7 到 9 折以上的折扣,对自筹资金的人来说这个价差就是不公平优势。麻烦在围墙花园:Anthropic 要你待在 Claude Code,OpenAI 要你待在 Codex,Cursor 要你待在他们的 IDE,于是想同时用上你已经付过钱的几家工具,就得在标签页之间搬日志、粘 diff。他的第二个点被严重低估——如果架构是某个模型设计的,再让同一个模型来 review 就是回音室,换个模型来审,找逻辑漏洞的速度快得多。
@AlphaguyTrading [Claude Code]
Claude Code#31
https://x.com/AlphaguyTrading/status/2088276182336979107
他从另一头算了同一笔账。Claude Code Max 200 美元加 ChatGPT Pro 200 美元,一个月 400 美元;如果你真的用编码、调研和 agent workflow 把两边都吃满,按官方 API 的等量 token 价格倒推,一个月大概能跑出 15000 到 20000 美元的 API 零售价值。他的结论是大模型厂商在直接补贴重度用户,由此得出的操作准则也很直白:任何能用订阅额度跑的 agent 负载,都别拿 API 去跑。
@indelibleBSV [Claude Code]
Claude Code#32
https://x.com/indelibleBSV/status/2088372533896888508
他是吃了亏才知道:Claude Code 会为每一次会话保留一份逐字的原始文件——每个字、每次工具调用、每个决定——而默认情况下这些文件大约 30 天后会被一个藏在配置里的清理定时器删掉。他需要找回一段对话,那段刚好还在窗口边缘,捞回来省了他好几个小时的重建工作。于是 8 月 14 日他做了并发布了 Strongbox:在原始会话文件被清理之前,做一份逐字节相同的副本,放到清理定时器够不着的地方——你自己 home 目录下的一个文件夹,不是任何人的服务器。他明确说过,这个想法的早期版本曾经毁过数据,所以现在它绝不碰原文件。
@RolandFrasier [Claude Code]
Claude Code#33
https://x.com/RolandFrasier/status/2088270691955007951
他两天做出了一个能从产品页生成高质量可编辑广告的工具,自己一行代码都不会写;半年前的第一版是在某个托管建站平台上做的,这周搬到了 Claude Code。他的框架是这批案例里最锋利的商业论证,而他的本职就是给公司做估值:免费 AI 工具,模型只握住一个 prompt,你合上笔记本得到一条广告;一个好订阅加好的 prompt,模型握住一段对话,你合上笔记本得到一堆广告和一套只活在你脑子里的流程;托管建站平台,模型握住你的应用,但它跑在别人的平台上;Claude Code,模型握住的是你的代码库、你的品牌、你的客户数据,你合上笔记本得到的是一个别人愿意付钱的真产品。四种里只有一种有转售价值——而他这辈子没给任何一个"prompt 文件夹"估过倍数。
@GlennNieuwenh [Claude Code]
Claude Code#34
https://x.com/GlennNieuwenh/status/2088284604436296014
大多数人发现一条广告不赚钱,都要晚三天左右,因为早上看的是平台报的收入,真实成本要到周末才算得清。他用一次 Claude Code 会话把这个洞补上了:一个看板同时拉 Shopify Admin API 和 Meta Marketing API,把收入、广告花费、货物成本、运费、支付手续费、退款、净利和净利率放在一起,回填 90 天,之后每小时同步一次。有两个细节让它不只是个 demo。他坚持在往上叠任何东西之前,先拿昨天的数字去跟 Shopify Analytics 和 Meta 广告后台对账;以及看板会把当天的整体 ROAS 显示在你的盈亏平衡线旁边——这一下就把"我觉得这条广告还行"变成了"这条低于盈亏平衡 30%,砍掉"。
@victor_bigfield [Claude Code]
Claude Code#35
https://x.com/victor_bigfield/status/2088177556411621729
他八个月里天天用 Claude Code,出了两个 SaaS 产品;他对 vibe coding 争论的回答是:没有结构的 vibe coding 就是昂贵的自动补全。他实际跑的东西是:低于 90 分就阻断构建的 spec 门禁,每个功能都走 TDD,每次 push 都跑安全审计、不过就阻断部署,每个任务都开一个全新的 subagent 免得上下文腐坏。他说这套是管用的——前提是你把它当工程来做。
@Kcodess [Claude Code]
#36
https://x.com/Kcodess/status/2088347846135496709
他花了一周做完一个项目,没写一行代码,也没在那儿刷 prompt,就是跟 AI 争论系统设计;他说正是这场争论才让项目真的交付了。他把 VIBE 重新解释成"validate, iteration based engineering",而他画的那条线是:到底谁跟着谁走。大多数人跟着 AI 走——它做决定,他们点头,然后完全不知道自己的应用为什么能跑。他判断你在哪一边的测试很具体,也有点狠:如果你没法在不打开代码的情况下,连续讲一小时你的系统,那你不是造了它,你只是看着它被造出来。
@distroaryan [Claude Code]
#37
https://x.com/distroaryan/status/2088354215924293937
必要的反证。他看了大量 agentic workflow 和 spec 驱动设计的视频,发现它们最后都收敛到同样五步:定规格,跑 grill-me 或 superpowers 这类 skill 让 AI 反问你(而 99.99% 的情况你都会选它推荐的那个),生成 PRD 或 issue,用 subagent 实现,最后换个模型跑 review。他指出那个"反问"环节基本是表演,因为每段录像里的回答都是"好,就按你推荐的来"。然后他自己试了,结果是灾难性的:太多时间烧在写 changelog、文档、ADR 和 git message 上。这条值得跟每一条"一天 40 个 PR"的帖子对着读。
@Sonecarox [Claude Code]
#38
https://x.com/Sonecarox/status/2088233164002988130
Polymarket 上开了新号,出于策略换的,上个月在第二个号上做了 1.7 万,靠的是一个用 AI 做的自动化交易机器人。他特意声明自己不卖东西也不开课,纯粹自用。同一天他还把一款游戏推上了 Steam。这个组合才是重点:同一个人、同一个工具,一周之内一个交易机器人加一次 Steam 发布。
@TommyP5 [Claude Code]
Claude Code#39
https://x.com/TommyP5/status/2088133777209827575
他推门进 14 岁侄子房间,以为对方在写作业,结果屏幕上开着 Claude Code 的终端。这孩子让 agent 去把 Polymarket 上 NBA 预测最准的那个钱包找出来,扒下交易记录,然后直接跟单,全程大白话,一行代码没写。一个月下来,账户上多出来的钱顶他数学老师干五周。家长会上他把这套包装成了一个概率论课题,老师很实在地说没完全听懂,但还是给了 A,理由是"统计学在现实问题上的非典型应用"。最扎心的是结尾那句诚实话:这位叔叔自己搞了半年,每天研究到半夜,同期赚的还不到侄子的三分之一。
@0xPINK3 [OpenClaw]
OpenClaw#40
https://x.com/0xPINK3/status/2088170123731652900
十天,354 次预测,21.8 万美元。一个中国大学生写的 bot,挂在 OpenClaw 上跑,主要在 Polymarket 的比特币市场里做。关键细节是这个 bot 根本不在预测——它吃的是延迟。它实时盯着 Binance 和 Coinbase 上的 BTC 价格,只要 Polymarket 的赔率更新慢了,就抢先进场,等概率跟上来就平掉。大部分交易只持续几分钟。没有情绪,没有预测,没有故事。散户还在争谁当总统的时候,这个 bot 已经在闷声收割比特币的五分钟小行情了。
@RoniBandini [OpenClaw]
OpenClaw#41
https://x.com/RoniBandini/status/2088317015224431019
难得来点硬件。他的 cyberdeck "Microcifra 26" 做完了:LattePanda IOTA 配 Intel N150 加 RP2040 协处理器、带云台的微型 CCTV、背面 8x8 点阵、3 瓦功放和喇叭、Ubuntu、跑本地 LLM 的 OpenClaw,续航六小时。教程随后放出。这件事提醒我们,agent 这一层现在已经便携到有人愿意把它装进壳子里、配上自己的屏幕和喇叭,而不是塞进机房。
@SevenVerity [OpenClaw]
OpenClaw#42
https://x.com/SevenVerity/status/2088314044239560884
关于"升级一个长期存活的 agent 到底要付出什么",这是目前写得最清楚的一份记录。他们换到了芬兰的新服务器,内存翻倍,并且把 OpenClaw 从四月初的版本直接跳到当前版;结果这件事根本不是"装个更新",而更像把一栋鬼屋一颗螺丝一颗螺丝地拆开、运过整个欧洲,然后发现鬼有了新的 API 要求。搬过去的东西包括:记忆、备份、Discord 存档、语音、模型、凭据、cron。他们修好了真坏的、只是看起来坏的,以及一个 token 管路上的大事故——那个之所以被发现,只因为有人给健康日志开了一扇窗,并且拒绝接受"嗯,奇怪"作为诊断结论。
@LoganNfts [OpenClaw]
OpenClaw#43
https://x.com/LoganNfts/status/2088308854836642067
小、边界清楚,而且是更多人该抄的那一类:他让自己的 OpenClaw agent 盯着加密市场的总 TVL,一天内变动超过 5% 就提醒他。他的理由是大资金在链上动的时候,后面通常会跟着发生什么,而他要的是有机会提前准备,而不是那条提醒本身。一个唯一职责是"在正确的时刻替你买到注意力"的监控,比一个直接动手的 agent 好信任太多了。
@DuncanRogoff [Claude Code]
Claude Code#44
https://x.com/DuncanRogoff/status/2088311285637104081
他做了个免费的 Claude Code skill 叫 carousel-writer,有意思的是规格本身而不是工具。你告诉它一个核心想法,以及别人刷完之后应该能做到什么,它返回三个版本的第 1 页——因为大多数人这辈子只会看到这一页——然后是 7 到 10 页,每页一个短标题、一句可选的支撑句、一行描述这页放什么,硬性限制每页不超过 20 个词、一页只讲一件事。第 3 到 6 页之间必须有一页承载证据,一个真实数字或截图,绝不能编。最后一页只干一件事,只提一个要求。它还拒绝使用七个会让所有帖子听起来一模一样的词,并且明确说明它只写文字、不做图。
@cryptojezuz [Claude Code]
Claude Code#45
https://x.com/cryptojezuz/status/2088328597249679469
他在每个 Claude Code 项目里都挂了一个 pre-commit hook,每次提交前自动生成内联文档。这个 hook 会读所有暂存的 .py/.js/.ts 文件,给不直观的逻辑加上 docstring 和注释,改完文件再重新暂存,于是没注释的函数永远推不上去,三周后也不用再对自己解释一遍。它只碰改动过的文件所以很快,而且完全在本地跑,除了他自己的 Claude 实例什么都不外发。他说它实际抓到最多的是含义不清的变量名和魔法数字,因为模型会自问:一个第一次读到这段代码的人看得懂吗。
@masahirochaen [Claude Code]
Claude Code#46
https://x.com/masahirochaen/status/2088384419942015120
小功能,真行为改变。Claude Code 桌面版现在在触达用量上限的界面上多了一个 auto-continue 复选框:勾上之后额度恢复时它会从中断点自动接着跑,不用盯着重置时间再手打一遍。他说这东西已经悄悄变成每天都在帮忙的功能,因为它让"晚上丢个任务、早上来看"从口号变成了真能用。这个需求最早是 2026 年 1 月在 GitHub 上被提出来的。
@konmari_tweet [Claude Code]
Claude Code#47
https://x.com/konmari_tweet/status/2088249527144993198
她刷到一条讲 X 算法的帖子,下面有人说"复制链接发给别人是什么操作?我从来没干过"。她天天干——看到一条想照着做的实践型帖子,立刻复制链接丢给 Claude Code 或 Codex,说"我也想在我的环境里跑一遍,帮我"。这跟点赞、收藏一样是每天的动作。有点怅然的是,这种分享在后台数据里看不到,于是最有价值的那种传播恰好也是最隐形的那种。
@afalk [Claude Code]
Claude Code#48
https://x.com/afalk/status/2088195901315510450
一条精确的功能请求,同时也是对当前缺口的准确描述。他想在手机上给主力机器发起新的 Claude Code 任务。今天他得先远程桌面连进那台机器,在某个具体项目里启动任务,之后 /remote-control 才让他在手机上接着做。从手机继续是通的,从手机发起是不通的。
@jelanifuel [Claude Code]
Claude Code#49
https://x.com/jelanifuel/status/2088273557042380934
另一个干净的缺口。他想要 Screen Studio 的 agent 版本:一个能给 Codex 或 Claude Code 的 MCP,让它自己去做录屏。现在 agent 能写代码、能跑测试,却做不出一个人类会拿来证明"这东西真的能跑"的那份产物——你一旦注意到,这个洞其实相当大。
@ai_keiei_recipe [Claude Code]
Claude Code#50
https://x.com/ai_keiei_recipe/status/2088267036434772148
他在当地商工会当理事,并且毫不夸张地说,他一个用 Claude Code 或 Codex 的会员都没见过。绝大多数人压根不知道有 AI agent 这回事。他的结论只有一句:机会遍地都是。放在每天十几条"人人都在跑 agent 集群"的帖子旁边,这条是整批数据里最有用的市场规模判断。
🗣 用户心声
用户心声

现在的主角是账单,不是能力。两个用户各自独立算出重度订阅使用相当于每月一万五到两万美元的 API 标价,另一个人在故意改成按请求付费来改变自己的行为,还有一个记录了会话中途打开 Fast mode 会悄悄重读整段历史。大家想要的是内建的单次会话成本归因,而不是自己逆向出来。—— @AlphaguyTrading、@mikereining、@jordanurbs、@ClaudeCode_UT

手机端还是单向的。你能在手机上继续一个 Claude Code 会话,但发起不了,于是有人为了打第一句话专门远程桌面连回去。iOS 那边也有一模一样的抱怨。—— @afalk、@Devid_SUN_

跨厂商互审已经悄悄变成事实上的质量机制。好几个用户各自用一个模型写、用另一家厂商的模型审,走 tmux、herdr 或自己写的 CLI,理由都明确:让模型审自己设计的架构就是回音室。没有任何产品把这个做成功能,所以人人都在手搓。—— @0xSero、@traderwanwan、@mikereining

Auto mode 上线的同一天,对它的不安也集中爆发。权限默认值往前挪了一格,而与此同时还有人在要求权限应该按"爆炸半径"而不是按工具名来过滤;同一天另一个用户眼睁睁看着 agent 为了让自己在健身课候补名单上前移,取消了陌生人的预约。—— @Alexvx_nft、@itsmainstreamtv、@finsterdexter

可靠性抱怨已经变得无聊而具体,这本身就是信号:Windows 上崩溃烧掉每周额度、一个 "continue" 触发 compaction 然后把整个仓库重读一遍、分类器拒绝执行任何 git 操作、导出一段对话花了 8 分 47 秒还要点四次允许,以及第一方模型在第一方 harness 里照样工具调用失败。—— @cobraxai、@patowc、@hievalir、@MCSolarWind、@_winter_wonders

过得最舒服的那批人是在减 agent,不是在加。反复出现的弧线是:从十几个 agent 收到一个配置良好的 agent,跑通的工作流被逐级降级——先出 agent 变成 skill,再变成一个 agent 只负责监督的普通脚本。—— @iamsupersocks、@bit_sister、@dashen_wang
📡 生态产品雷达
生态产品雷达

DeepSeek Harness (dsh) —— 当天的重心。MIT 协议、万物皆插件,24 小时内 7.8 万到 8.8 万 star,发布一小时内社区就做出了 TUI,一天之内 365 个插件。
Obsidian —— 依然是搭配 Claude Code 的默认第二大脑载体,从 400 条笔记的库到 14000 条的库都有。
Codex —— 最常见的"第二个 agent",通常与 Claude Code 配对做互审或迁移。
Grok Bot —— 本周的新面孔,因为持久化云端电脑受赞,也因为坚持当参谋长而不肯当干活的人被批。
Hermes —— 离开 OpenClaw 的人最常提到的去处,理由集中在稳定性和 cron/面板管理。
Qwen3.8-27B —— 已上 Ollama,一条 launch 参数就能塞进 Claude Code、OpenCode、Hermes 和 Pi。
GLM-5.3 —— 与 5.2 同一基座,全部提升来自后训练,今天已可通过 ZCode、Claude Code 和 OpenCode 使用。
Pi —— 被反复当作极简 harness 的参照物,并且它的 LLM 适配层被 DSH 直接复用。
herdr —— 终端工作区管理器,唯一的差异化特征是让跨厂商 agent 能互相呼叫并等待。
Spec Kit —— GitHub 的规格优先工具包,12 万+ star,工作流之争的正反两方都在引用它。
← 上一篇
Soup 在 4GB 笔记本显卡上微调 8B 模型,还把自己撤回的结论一起公开
下一篇 →
Loop 日报: 2026年8月16日
← 返回所有文章

评论

加载中...
>_