DC娱乐网

Anthropic 连发 Claude 双模型,行业竞争再升级

近日,Anthropic 密集发布两款 Claude 系列大模型 —— 旗舰版本 Claude Opus 4.8 与全新

近日,Anthropic 密集发布两款 Claude 系列大模型 —— 旗舰版本 Claude Opus 4.8 与全新中端主力 Claude Sonnet 5。前者小幅优化性能、维持原价,后者以 “旗舰级九成能力、半价成本” 为核心卖点,直指规模化 AI 部署市场,也将全球大模型行业的价格竞争推向白热化。

作为当前 Anthropic 的技术天花板,Claude Opus 4.8 定位旗舰级复杂任务处理,是 Opus 4.7 的迭代版本Anthropic。此次升级以性能微调与稳定性优化为主,核心能力聚焦高强度推理、复杂代码生成与高精度知识处理,在智能体编程、终端操作等基准测试中保持行业顶尖水平。定价层面,Opus 4.8 维持不变,为每百万输入 token 5 美元、输出 token 25 美元,面向企业级核心场景与高难度专业任务,主打 “高性能优先”Anthropic。

与旗舰版的保守迭代不同,Claude Sonnet 5 是 Anthropic 面向 AI Agent 时代的重磅产品,官方定位为 “迄今为止最具 Agent 属性的 Sonnet 模型”。其核心突破在于大幅拉近与旗舰的性能差距:在 SWE-bench Pro 智能体编程测试中得分 63.2%,高于前代 Sonnet 4.6 的 58.1%,逼近 Opus 4.8 的 69.2%;在 Terminal-Bench 2.1 终端操作测试中达 80.4%,远超前代的 67.0%;甚至在 GDPval-AA v2 知识工作基准中,以 1618 分小幅超越 Opus 4.8 的 1615 分。更关键的是,Sonnet 5 具备自主规划、多工具调用、长时间自主运行能力,可独立拆解复杂任务、调用浏览器与终端,完成数月前仅旗舰模型能实现的工作。

定价策略是 Sonnet 5 搅动行业的核心抓手。发布初期(截至 8 月 31 日)实行限时优惠,每百万输入 token 仅 2 美元、输出 token 10 美元;优惠期后标准价为输入 3 美元、输出 15 美元,仅为 Opus 4.8 价格的 60% 左右。同时,模型新增可调节努力档位(Effort Levels),开发者可根据任务复杂度平衡成本与性能,适配从轻量对话到复杂 Agent 任务的全场景需求。不过需注意,Sonnet 5 采用全新分词器,同等文本生成 token 数量较前代增加 1.0-1.35 倍,实际使用成本需结合 token 消耗综合测算。

此次双模型发布,恰逢全球大模型行业竞争加剧、Anthropic 冲刺 IPO 的关键节点。一边是 OpenAI、谷歌等头部玩家持续迭代模型、调整定价,另一边是中端市场需求爆发,企业对 “高性价比、可规模化部署” 模型的需求激增。Anthropic 以 Opus 4.8 守住高端市场技术壁垒,用 Sonnet 5 以 “旗舰平替” 姿态抢占中端规模化市场,形成 “高端赚利润、中端抢份额” 的差异化布局。

从行业影响来看,Sonnet 5 的发布直接点燃大模型价格战。此前 OpenAI 新一代模型定价上调,而 Anthropic 反向操作,以半价提供接近旗舰的性能,迫使行业重新平衡性能与成本,倒逼竞品优化定价策略。同时,Sonnet 5 的 Agent 能力突破,进一步推动 AI 从 “对话工具” 向 “自主智能体” 演进,降低企业部署 Agent 应用的门槛,加速 AI 在办公、开发、数据处理等场景的规模化落地。

长远来看,随着技术迭代加速,大模型行业正呈现 “高端技术深耕、中端性价比为王” 的分化趋势。Anthropic 的双模型策略,既是对当前市场需求的精准回应,也为行业提供了新的发展范式 —— 未来大模型竞争,不再单纯比拼单一性能,而是兼顾性能、成本、场景适配的综合实力。而这场由 Sonnet 5 掀起的价格战,最终受益的将是广大企业用户,推动 AI 技术从 “奢侈品” 向 “普惠工具” 加速转变。