Argon的低价是促销价,正式价翻倍。谷歌9月30日发布Gemini4Argon,介绍价是每百万token输入2美元、输出10美元,介绍期结束后是4美元和20美元。第三方评测机构ArtificialAnalysis用同一套题测下来,Argon每题1.99美元,正式价是3.98美元,约为GPT-6Astra的1.2倍。现Argon的低价是促销价,正式价翻倍。谷歌9月30日发布Gemini4Argon,介绍价是每百万token输入2美元、输出10美元,介绍期结束后是4美元和20美元。第三方评测机构ArtificialAnalysis用同一套题测下来,Argon每题1.99美元,正式价是3.98美元,约为GPT-6Astra的1.2倍。现在买不到,预算也别按2美元排。Argon目前只发给一批可信的网络防御者,付费API客户排在后面,谷歌没给日期,介绍期何时结束也没说。便宜靠单价打折,没靠省token。Argon每题平均输出6.2万个token,Astra是2.7万。智力指数并列第一,终端任务只排第四。开发者要按自己的任务测,别只看总榜。介绍期一过,每题成本翻一倍谷歌写明介绍价之后是4美元和20美元,缓存输入便宜95%。ArtificialAnalysis的说法是现在打了五折,介绍期至少一个月,结束日期谷歌没有确认。项目|每百万token输入/输出|每题平均成本|每题平均输出tokenArgon介绍价|2/10美元|1.99美元|6.2万Argon正式价|4/20美元|3.98美元|6.2万GPT-6Astra(max)|本文未取|3.26美元|2.7万按介绍价,Argon每题成本是Astra的60%。按正式价,成了Astra的1.2倍。差在表里最后一列。Argon做完一道题要吐出两倍多的token,单价打折压住了这一点,折扣一撤就压不住。强项是幻觉少,弱项在终端任务Argon在智能指数上得53分,与GPT-6Astra并列,比GPT-6.1Sol高1分,比谷歌上一款非Flash模型Gemini3.1ProPreview高23分。最亮的一项是幻觉率15%,Astra是51%,Sol是54%。这项要带一个条件看。Argon的准确率是50%,比Astra的63%低13个百分点。幻觉率低,是因为它更常承认不知道,不是答对的更多。智能体榜单上它一强一弱。AutomationBench-AA它得78%,排第一,领先Sonnet5.5约7个百分点。TerminalBench4它得57%,排在Sonnet5.5的64%、Opus5.5的60%和Astra的59%后面,第四。谷歌自己报的DeepSWEv1.1是77.9%,它称这是新的最好成绩,这类数字是谷歌自测,要等独立复测。先给防御者,是把公众排到了最后Argon现在只通过Fairwind计划发给一批可信的网络防御者,给他们的版本没有网络安全护栏,谷歌同时在走美国政府的发布前自愿审查流程。之后是付费API客户和GoogleAIUltra订阅者,再往后才是开发者、企业和普通用户。Anthropic的ClaudeMythosPreview此前也只发给审核过的防守方。反方的解释同样成立。模型能自己找漏洞、验证、打补丁,先发给防御者也许只是安全审查的正常节奏。谷歌说Wiz用它在医院使用的软件里找到一个严重漏洞,这是谷歌的说法,没写是哪家软件。鉴曰:看到「最强模型发布」,先问谁现在能用、什么时候能用、多少钱,再问有多强。