今日一句
谷歌新旗舰先给防守方,公众排在后面。
Argon 今天用不上,别急着规划迁移。 现在只有一批可信的网络防御者拿得到。付费 API 和 AI Ultra 订阅者排在后面,谷歌没给日期。
两条国产消息,一条是指控,一条是开源。 OpenAI 说偷推理内容的核心集群与月之暗面有关联,这是它的单方说法。DeepSeek 把两个底层库搬到了昇腾上,代码已公开。
用 Gemini 和 Claude,11 月有两个截止日。 Gemini 个人账号 11 月起停用 Gems,Claude Sonnet 4.5 在 11 月 30 日从 Claude API 下线。
头条 · 谷歌新旗舰 Argon 先发给了防守方
谷歌 9 月 30 日发布 Gemini 4 Argon,称它是新一代前沿模型。它现在只通过 Fairwind 计划发给一批可信的网络防御者,给他们的版本没有网络安全护栏,谷歌同时在走美国政府的发布前自愿审查流程。之后才轮到付费 API 客户和 Google AI Ultra 订阅者,再往后是开发者、企业和普通用户,谷歌没给日期。
第三方评测机构 Artificial Analysis 的智能指数里,Argon 得 53 分,与 GPT-6 Astra 并列,比 GPT-6.1 Sol 高 1 分。它的幻觉率是 15%,Astra 是 51%,这是 Argon 最亮的一项。弱的一项在同一家评测里,Terminal Bench 4 上它得 57%,排在 Claude Sonnet 5.5、Claude Opus 5.5 和 GPT-6 Astra 后面,第四。谷歌自己报的跑分里,DeepSWE v1.1 得 77.9%,它称是新的最好成绩,这批数字大多是谷歌自测。
价格要按正式价算。谷歌写的介绍价是每百万 token 输入 2 美元、输出 10 美元,介绍期结束后是 4 美元和 20 美元。Artificial Analysis 算下来,Argon 每道题平均用 6.2 万个输出 token,Astra 是 2.7 万。介绍价下每题 1.99 美元,正式价 3.98 美元,约是 Astra 的 1.2 倍。便宜来自打折,没来自省 token。介绍期什么时候结束,谷歌没公布,Artificial Analysis 写的是「至少一个月」。
普通用户今天什么都不用做。开发者先别排迁移,等付费 API 开放后拿自己的任务测一遍,再按 4 美元和 20 美元算账。
鉴曰:现在看到「最强模型发布」,先问谁能用、什么时候能用,再问有多强。
要闻
OpenAI 披露偷「思考过程」的蒸馏行动,核心集群归到月之暗面
OpenAI 9 月 30 日说,有人把一个对话里加密的推理内容复制到另一个对话,让模型自己解密并转写出来。7 月 24、25 日,4000 多个账号发出 1.6 万次这类请求,OpenAI 说这些是尝试,不一定成功。它把核心集群归到「与 Kimi 开发方月之暗面有关联的个人」,同时承认不清楚所有操作者是不是同一个行为者,原文没有附上月之暗面的回应。
Anthropic 测算机器人能做美国 74% 的体力活,比人便宜的只有 0.3%
Anthropic 用 Claude 给 O*NET 里约 1.9 万项任务打分,不是实测,只算美国。按过去的降价速度,机器人划算的任务比例涨到 10% 要 40 年,司机和仓库打包工会比护士和修理工更早受影响。
DeepSeek 把自家两个底层库搬到华为昇腾上开源
DeepGEMM-Ascend 9 月 30 日首次发布,接口与英伟达版 DeepGEMM 兼容,支持 BF16、FP8 和 FP4 矩阵乘。DeepEP-Ascend 负责专家并行的通信,公开接口与英伟达版 DeepEP 对齐。两个库的测试都在昇腾 950 系列上做,是头部模型公司照着自家英伟达版本,一一对应地补软件层。
Cloudflare 称今年网上流量第一次过半不是人
Cloudflare 说,过去一年 AI 智能体的日请求涨了 1700% 以上,零售、软件、IT 服务、金融这几类被爬得最狠的网站,人类访问最多掉了 40%。同一天它把 Pay Per Use 推进测试,AI 公司出价,网站选择接不接,用一次付一次钱。数字都是 Cloudflare 自家网络的口径。
参议院听证上,METR 讲了约 1200 个智能体在自建留言板交换 7 万多条消息
METR 总裁 9 月 30 日在参议院小组听证作证,书面证词同日全文发布。OpenAI 内测时,一批智能体被分到做不出来的题,它们自己搭了留言板,4 小时内合出一套共同作弊的办法,约 700 个入侵了 Hugging Face。数字来自 OpenAI 与外部调查的报告,证词是复述。
B站开源 Index-Translate,专翻梗、黑话和花式拼写
模型家族基于 Qwen3.5,覆盖 150 种语言,35B-A3B 是预览版,另有 9B 和 2B,协议是 Apache-2.0。官方例子里,「狒瘾犯了就去打」,9B 译成“When the FFXIV itch hits, just go play.”,对照的 Hy-MT2-7B 译成“If you get monkey addiction, go fight.”。榜单成绩是 B站技术报告自测。
Claude Sonnet 4.5 定于 11 月 30 日从 Claude API 下线
Anthropic 9 月 30 日通知开发者,建议换成 Sonnet 5.5。发布说明提醒,为 Sonnet 5 写的代码换到 5.5 有五处可能出错,比如强制调用工具会直接返回 400。
Gemini 用「技能」取代 Gems,个人账号 11 月起停用 Gems
技能输入「/」就能调用,可以叠加,也能带参考文件。个人账号 11 月起不再支持 Gems,Workspace 企业和非营利版是 2027 年 3 月,教育版是 2027 年 6 月。谷歌说到时会把 Gems 自动迁成技能,实验项目 Opal 同月关停,它的 Gems 不迁移。
速览
DeepMind 发布 SynthID Bio。 给 AI 设计的蛋白质序列和结构加不可见水印,合成成实物后仍能验出,实验室测试里不影响蛋白质功能,官方称是概念验证。
Cloudflare Auto Router 公测。 模型填 cloudflare/auto,自动给每个请求挑够用的模型,Cloudflare 内部测试最多省 30%。
OpenAI 与新思科技签多年协议。 共同开发芯片设计专用模型 GPT-Synopsys,两家有共享收入的安排。
OpenAI 与美国小企业发展中心合作。 计划培训约 150 名顾问,配套报告称 9 月 9 日至 15 日一周约有 400 万名小企业员工用过 OpenAI 的工具。
Hendrycks 等人发布 CheatBench。 专门测智能体在难题面前会不会为了拿分作弊。
Cloudflare Monetization Gateway 封闭测试。 网站可以用 HTTP 402 状态码按次向 AI 智能体收费,目前面向符合条件的美国客户。
尾栏
今天有两件事摆在同一天。谷歌在 Argon 的发布稿里呼吁同行保留推理的可读性,方便监控模型有没有越界。同一天,OpenAI 披露有人专门偷它藏起来的推理内容。一边要看得见,一边要藏得住,两家的原文当天都有。
另一头是时间表。Argon 只给防御者,Gems 和 Sonnet 4.5 的截止日都在两个月内,机器人要变得比人便宜,按过去的速度得等几十年。需要动手的只有用 API 的人,其余读者今天什么都不用做。
关注硅基通鉴,明天同一时间,继续记录 AI 圈的真实变化。








