DC娱乐网

一图看懂 GPT-6 Astra 贵在哪,强在哪

GPT-6 Astra 今天凌晨发布了,我熬夜做了两张对比图,帮大家省流👇
先说结论:最强,但也是最贵的。
💰 价格(每 100 万 tokens)
Astra 输入 10 刀、输出 50 刀。什么概念?跟 Claude Fable 5 打平,是 Kimi K3 的 3 倍多,是 DeepSeek V4 Pro 的 12 倍。就连自家的 GPT-5.6 Sol 也只收 4/20 刀。预算紧张跑批量任务的,GPT-5.6 Luna 输入才 0.2 刀,香得很。
📊 那贵出来的钱花哪了?
三个硬指标全线第一:
科学推理 96.0%(Claude 92.6%)
代码任务 74.1%(Claude 70%)
高难度数学 97.6%——这个最夸张,上一代 Sol 才 83%,Claude 87.8%,直接断层
🆕 这次 GPT-6 重点更新了啥?
1️⃣ 会自己用电脑了。不用软件开放接口,它像人一样看屏幕、点鼠标、打字。Excel、PPT、装软件、看报错排障都能干。真实电脑环境测试成功率 72.6%,干活速度还快了近一半
2️⃣ "悟性"碾压。有个专门测 AI 悟性的变态考试(没说明书没规则的游戏自己摸索),人类平均 48 分,Astra 99.9 分。OpenAI 总裁直接放话"欢迎来到 AGI 时代"
3️⃣ 审美在线了。以前 GPT 做 PPT 丑出圈,这次版式、视觉风格大幅加强,还能从一张图建 3D 模型再渲染成能走进去的场景
4️⃣ 更"懂事"了。小事自己拍板不烦你,真正影响方向的才停下来问一句。带过团队的人都懂这有多重要
5️⃣ 更守规矩但更能打。越权行为测试 0 次,幻觉率降到 2%;但它是史上第一个被判定为"网络安全 Critical 级"的模型,能自己挖出没人发现过的系统漏洞,还顺手找到两个零日。能力越强,越让人又期待又紧张
💡 我的选择建议:
▫️日常写代码、干活 → GPT-5.6 Sol / Luna,够用还便宜
▫️复杂项目、让 AI 全自动跑完一整件事 → Astra
▫️预算优先 → DeepSeek、Kimi,日常够用,价格是真香
图 1 是 GPT 全家桶对比,图 2 是四家头部模型横评,左滑自取~
#GPT6 #GPT6发布