DeepSeek 终于开口说话了:灰度测试语音对话,四种音色上线。
9 月 1日,有用户反馈显示,DeepSeek App 已开启语音对话功能的灰度测试。部分测试用户在应用右上角发现了一个小喇叭按钮,设置页面也新增了“朗读音色”选项,提供四种风格鲜明的声音选择:贝壳(百变活泼)、白浪(明朗坚定)、海星(俏皮甜美)和暗潮(低沉浑厚)。
长期以文字交互为主的DeepSeek,正式迈入“能听会说”的语音时代。此前它在多模态上已有视觉理解能力,但语音交互一直是短板。
语音对话并非简单的“文字转语音”。对用户而言,它意味着输入方式的解放。开车、做饭、散步时,不必再盯着屏幕打字,动口即可提问;对老人、孩子或视力不便的群体,门槛大幅降低。输出端则从冷冰冰的文字变成可听的声音,信息接收更轻松,尤其适合长回答或需要边听边思考的场景。
贝壳的活泼适合轻松闲聊,白浪的坚定适合正式解答,海星的甜美偏亲和陪伴,暗潮的浑厚则带有沉稳权威感。用户可根据场景或个人偏好切换,行业观察者指出,DeepSeek。此举是第一次在同一入口同时整合输入与输出两种模态。此前其多模态主要停留在视觉层面(如 V4 系列的图片理解),语音的加入补齐了交互闭环。若后续进一步接入Agent调用链,语音将成为更完整的智能助手入口,而非单纯的朗读功能。
DeepSeek 从“只会打字”到“能听会说”,表面看是功能叠加,实质是交互范式的转变。大模型的价值最终要落到用户日常体验上——能更自然地提问、更轻松地获取信息、更像“对话”而非“查资料”。
四种音色的上线,也透露出产品团队对“人设”和情感连接的思考。AI 不再只是冰冷的知识库,而是可以带有性格、适应不同场景的陪伴者。这对教育、陪伴、客服、内容消费等场景都具有现实意义。
目前功能仍处灰度阶段,并非所有用户都能立即体验。DeepSeek 正在从技术领先向产品体验全面发力,在国产大模型激烈竞争的当下,谁能更快、更好地把能力转化为自然、好用的交互,谁就更有机会赢得用户。