今日AI热点:顶级模型开始争夺“实时速度” 热搜AI创作激励大赛OpenAI预览Ultrafast模式
AI的下一场竞争,可能不只是“谁更聪明”,而是谁能把顶级智能压缩到实时。
美国当地时间8月13日,OpenAI预览了新的Ultrafast服务:在Cerebras计算系统支持下,GPT-5.6 Sol的生成速度最高可达每秒750个输出Token,约为标准处理速度的14倍。
这个数字真正值得关注的地方,不是“回答出现得更快”,而是AI的工作方式可能因此改变。
过去,使用能力更强的模型,通常意味着等待更久;想要实时响应,则往往需要换成功能较弱的小模型。Ultrafast试图打破的,正是智能与速度之间的取舍。
如果顶级模型能够稳定进入这一速度区间,AI写代码将更接近人的操作节奏;复杂智能体可以在几秒内完成多轮规划和工具调用;客服、金融分析、实时研究与交互式创作,也可能从“等待AI返回结果”变成“人与AI同步工作”。
但这里仍有三个重要前提:750 Token/秒是最高输出速度,不代表所有任务都能持续达到;输出速度不等于完整任务的端到端耗时;目前该服务只向少数API客户开放预览,并不是ChatGPT已经全面提速。
所以,这次发布真正释放的信号是:AI行业的竞争指标正在改变。
过去比的是“一个模型能够回答多难的问题”,接下来比的可能是“它每秒能够完成多少有价值的工作”。
当顶级AI快到几乎不再需要等待,它还只是一个工具,还是会真正进入人类工作的实时决策链?
人工智能GPT56AI推理速度Cerebras
