最新 · Latest
2026年8月16日
Claude 开始给所有文字打水印,唯独代码打不上
Anthropic 8 月 14 日把 Claude 文本水印的原理讲清楚了。有意思的不是水印本身,是水印失效的地方。
方法是这样。Claude 一个 token 一个 token 地生成,每一步都有一堆候选词。这些选择里大部分无关紧要——用这个同义词还是那个,从句放前面还是后面。水印就是拿这些无所谓的选择做文章,按一个密钥去偏置它们,让整段文字带上一个读…
2026年8月14日
每秒 750 个 token,agent 的定位就变了
OpenAI 和 Cerebras 把 GPT-5.6 Sol 跑在晶圆级芯片上,输出速度到了每秒 750 个 token。Artificial Analysis 测出来是 Fable 5 的 11 倍,是 Opus 4.8 开 Fast 模式的 5 倍。名字叫 GPT-5.6 Sol Ultrafast,现在在 OpenAI API 上限量预览。
原理又…
2026年8月14日
Gemini 3.7 Flash:三周迭代,价格砍半
Google 发了 Gemini 3.7 Flash,距离 3.6 Flash 只有三周。三周。到 2026 年底的促销价是每百万输入 0.75 美元、输出 3.75 美元,正好是 3.6 Flash 上线价的一半。一家公司在上一代发布一个月内就把价格砍半,这不叫路线图,这叫纠错。
数字解释了这份急迫。DeepSWE v1.1 从 49.0% 涨到 65.…
2026年8月13日
DeepSeek V4 Pro 正式版落地,真正的新闻是那句涨价预告
DeepSeek 的旗舰今天出预览了。V4 Pro 0813 成为 deepseek-v4-pro 端点背后的正式版本,将近四个月的预览期结束。参数是 1.6 万亿总参、每 token 激活 490 亿,100 万 token 上下文,最大输出 38.4 万 token。混合注意力,调的方向是全代码库分析和长周期工作流,不是聊天。
定价从预览期原样继承。输…
2026年8月11日
Mistral 手里有一项 code-mode 工具调用的专利
美国专利 12670045 B1,标题「Code implemented tool calls」,2026 年 3 月 4 日申请,6 月 30 日授权给 Mistral。昨天在 Hacker News 上被翻出来,192 分,大部分人在算它到底盖住了多少东西。
它大致盖住的,是过去一年半个生态迁过去的那个模式:模型不再为每次工具调用吐一坨 JSON 然后…
2026年7月31日
GPT-5.6 打骨折:OpenAI 把 Luna 砍了八成
OpenAI 7 月 30 号给 GPT-5.6 降价,便宜那头砍得很狠。最省的 Luna 直接降 80%,input 每百万 token 两毛钱,output 一块二。中间的 Terra 降 20%,两块和十二块。旗舰 Sol 不动,还是五块进、三十块出。
OpenAI 的说法叫价格性能前沿,翻译过来就是打价格战。但真正值钱的数字不是折扣本身,是便宜档位…
2026年7月25日
Claude Opus 5 来了:前沿的活,一半的钱
Anthropic没等IPO路演就把王炸先甩了。Opus 5发布,话说得很直白:前沿级别的活,价格只有Fable 5的一半。
数字才是重点。Frontier-Bench上,它把Opus 4.8的分数翻了一倍还多,成本反而更低。CursorBench 3.2上,只差Fable 5峰值不到半个百分点,钱只花一半。ARC-AGI 3是次优模型的三倍。OSWorl…
2026年7月24日
Echo赌的是:前沿不是一个模型,是一个指挥家
Tracer,一家Y Combinator孵化的实验室,刚发布了Echo,它的主张带点异端味道。别去挑那个最强的模型,Echo把一堆开源权重模型攒成一个系统,藏在一个兼容OpenAI的接口后面。创始人Adam Rida说这是个实验,把很多模型捏成一个AI。有的请求只用小模型跑一点点推理,有的请求让好几个模型各啃一块,调用方完全看不到接缝。
它甩出的数字是大…
2026年7月22日
Gemini 3.6 Flash:Google这次调的是agent,不是聊天
7月21日Google一口气发了三个模型,唯独没发大家等的那个。没有Gemini 3.5 Pro。落地的是Gemini 3.6 Flash、Gemini 3.5 Flash-Lite,还有一个叫3.5 Flash Cyber的安全专用模型。看完发布说明优先级很清楚:这一批是给循环里跑的东西准备的,不是给回答问题的东西准备的。
3.6 Flash的头号数字不…
2026年7月20日
OpenAI 把 Codex 上下文砍回 272K:多出来的窗口一直在烧你的额度
OpenAI 把 Codex 里 GPT-5.6 Sol 的上下文上限从 372K 砍回了 272K。官方解释来自 Codex 负责人 Tibo:372K 的上线是订阅额度消耗异常飙升的主要原因之一。窗口变大,每个请求计费的 token 就变多,订阅用户眼看额度蒸发却不知道为什么。这次回滚加上新的推理优化,大约能还给用户 10% 的用量;OpenAI 说以后…
第 1 页
较早 →
招聘 · Hiring
AI Agent 公司最新职位,开放即收录。
xAI
Porter Supervisor
xAI
Hospitality Supervisor
xAI
Executive Sous Chef
xAI
Executive Chef
xAI
Cook
xAI
Barista