据OpenAI官方公布,其最新模型GPT-4o正式发布。该模型最大的突破在于实现了原生多模态能力,能够以毫秒级延迟处理文本、音频和视觉输入。这意味着AI不仅能“看懂”和“听懂”,还能像真人一样实时观察用户的表情和语气并作出自然回应。GPT-4o将免费向所有用户开放,这标志着AI交互体验从单纯的文本对话,正式迈入更自然、更流畅的实时多模态时代,有望大幅降低普通用户的使用门槛。

据OpenAI官方公布,其最新模型GPT-4o正式发布。该模型最大的突破在于实现了原生多模态能力,能够以毫秒级延迟处理文本、音频和视觉输入。这意味着AI不仅能“看懂”和“听懂”,还能像真人一样实时观察用户的表情和语气并作出自然回应。GPT-4o将免费向所有用户开放,这标志着AI交互体验从单纯的文本对话,正式迈入更自然、更流畅的实时多模态时代,有望大幅降低普通用户的使用门槛。
