最新 · Latest
2026年8月17日
MathCode 把终端变成了一台 Lean 4 证明机
Math-AI 团队放出了 MathCode,一个内嵌数学形式化引擎的终端编码 agent。你用大白话说一个问题,它转成 Lean 4 定理,然后去证。619 星,建在他们之前的 AUTOLEAN 上,周末上了 Hacker News。
真正让它可用的工程细节是常驻的 Lean REPL。Lean 的编译周期是 agent 做证明的杀手——每次检查大约 3…
2026年8月17日
HarnessRouter 把大家都在重复造烂的那层开源了
如果你试过把 Codex、Claude Code 和 Hermes 塞到同一个产品界面后面,你知道那笔税有多贵。每个 harness 有自己的会话模型、自己的流式格式、自己的文件和产物处理方式、自己对"取消"的理解,以及自己那一套跑到一半挂掉的姿势。HarnessRouter Community Edition 这周由 YC 背景的团队按 Apache 2.…
2026年8月17日
Anthropic 的系统提示词更新日志,泄露的不只是提示词
Anthropic 有一个公开页面,放着 claude.ai 和手机 app 背后的系统提示词。这页存在有阵子了,但这个周末冲上 Hacker News 首页,450 分 196 条评论。按时间顺序读一遍这些条目,其实是重建这家公司到底发过什么的一个不错的办法。
当前最新一条是 Claude Opus 5,7 月 24 日。里面提到了 Claude Myt…
2026年8月17日
模型是故意变笨的,而且这条路走对了
Walter van der Giessen 周一发的这篇,两小时内冲上 Hacker News 首页,反应是对的。他的判断是:各家实验室在刻意拿事实存储换推理能力,而所有把冷知识 benchmark 下滑读成退化的人,把因果读反了。
证据是参数量。GLM-5.2 用 40B 激活参数在 AIME 2026 上拿 99.2%。Qwen3.5 用 17B 激…
2026年8月17日
AI 额度有个灰市,比你想的大
终于有人把 AI 额度转卖市场摸了一遍,文章这个周末冲上了 Hacker News 首页。一句话版本:没用完的 OpenAI、Anthropic、Google、微软额度正在以三到八折转卖,而且量大到不能忽略。
供给端是创业公司额度。每个加速器、每个云厂扶持计划都在发五位数六位数的 API 额度,大部分公司根本烧不完。以前这些是在创始人群里私下换,现在已经是…
2026年8月17日
LycheeMemory V2:晚一点写,成本降 86%
几乎所有 agent 记忆系统都是每轮对话之后做一次固化。agent 说完一句,系统编码、建索引、归档。8 月 13 日挂出的 LycheeMemory V2,来自 Dongfang Li 带的一个中国团队,问了一个明显但没人问的问题:凭什么按轮?
他们的答案是改成按语义段固化。先检测一个话题到底在哪儿结束,然后把整段当成一个单位编码。昂贵的编码动作触发频…
2026年8月17日
LLMRouter 把路由的价值算出来了:14.6%。Stripe 刚花 70 亿表示同意。
Tao Feng、Jiaxuan You 等十二人 8 月 7 日在 arXiv 挂出 LLMRouter,之后一直挂在 HuggingFace 论文榜前列。时机有点好笑——一篇论证模型路由为什么重要的论文,发出来九天后 Stripe 把市面上最大的路由器买走了。
核心动作是把路由当成一个序贯决策过程,而不是一张查找表。拆成五块:上下文编码器、模型编码器、…
2026年8月17日
Anthropic 的 IPO 定价,押在一个 2028 年没人能核实的数字上
路透社找到两位了解 Anthropic 财务的人,说出了支撑这次 IPO 的那个预测:2028 年收入 1900 亿到 2000 亿美元。而五月份公司自己对外说的还是 470 亿的年化流水。也就是说,讲给华尔街的故事是两年翻四倍。
这里的机制值得搞清楚。银行家给 Anthropic 定价用的是企业价值对未来收入的倍数,不是过去收入——高增长又还没盈利的公司…
2026年8月17日
Stripe 70亿美元买下 OpenRouter,收费站才是生意
彭博社周六爆的料:Stripe 已经敲定收购 OpenRouter,价格超过 70 亿美元。五月份 OpenRouter 刚拿了 1.13 亿美元 B 轮,估值 13 亿,投资方是 Sequoia、a16z、Menlo 和 Alphabet 旗下的 CapitalG。三个月,五倍。Stripe 对 TechCrunch 的回应是不评论传闻。
OpenRou…
2026年8月16日
模型没动,成绩涨了三倍
ARC-AGI-3 从 13.3% 涨到 38.3%。同一份权重,同一个 GPT-5.6 Sol,没有重训任何东西。OpenAI 只是让它在两步之间保留自己的推理、而不是扔掉,再加上上下文压缩。改了一段管道,分数翻三倍。
看到这个数字之后你就回不去了。过去两年,所有人都在给错误的对象打分。
说白了 harness 就是这么回事。模型是泡在罐子里的一颗大脑…
第 1 页
较早 →
招聘 · Hiring
AI Agent 公司最新职位,开放即收录。
ElevenLabs
Strategic Account Executive - Colombia
xAI
Porter Supervisor
xAI
Hospitality Supervisor
xAI
Executive Sous Chef
xAI
Executive Chef
xAI
Cook