最近,大模型产品 DeepSeek 在其手机 App 端悄然开启了原生语音对话功能的灰度测试。部分被选中的测试用户发现,对话界面的右上角多了一个“小喇叭”图标,点击即可开启双向语音对话。同时,App 的设置页面中也新增了“朗读音色”选项,这意味着长期以文字交互为主的 DeepSeek,开始正式迈入“能听会说”的阶段。
从目前测试释放出的信息来看,DeepSeek 提供了四款以海洋为主题的音色选择,分别是百变活泼的“贝壳”、明朗坚定的“白浪”、俏皮甜美的“海星”以及低沉浑厚的“暗潮”,整体包含了男声与女声的不同风格。根据首批体验者的反馈,这次更新的语音自然度较高,在语调、断句和节奏处理上比较自然,没有传统机器合成音那样生硬的机械感。不同用户也对音色展现出了各自的偏好,例如有的用户偏爱甜美亲和的风格,有的则更倾向于沉稳浑厚的嗓音。
在实际使用场景中,语音对话功能的加入显著扩展了产品的应用边界。过去,用户在接收深度思考或长文回答时,往往需要长时间注视屏幕阅读。而有了语音朗读和对话能力后,大段的内容可以顺畅地转化为“可听”的音频。这极大解放了用户的双手和双眼,非常契合日常通勤挤地铁、做家务、做饭或是休息养神等不便打字的场景。此外,语音交互也大幅降低了操作门槛,让老年人、儿童以及视力不便的群体能够更无障碍地使用 AI 技术。
评价 DeepSeek 这次灰度测试语音功能,不仅要看到一项新工具的上线,更要看到其背后产品形态与交互范式的演进。
这是 DeepSeek 补齐多模态交互闭环的重要一步。在此之前,产品主要依赖文字交流和图像识别能力,语音一直是一块相对缺失的拼图。将语音输入与输出整合进统一入口,让 AI 从“只能看”变成“能听会说”,使其在功能完整度上向更为成熟的通用智能助手靠拢。
四种不同风格音色的设计,体现了产品在用户体验和情感连接上的思考。AI 不再只是一个冷冰冰的知识检索库,通过赋予其各具特性的声音,能够适应正式解答、轻松闲聊或是日常陪伴等不同语境,让交互过程更具亲和力与人性化色彩。
这也展现出 DeepSeek 正在从纯技术驱动向注重用户日常细节体验倾斜。近期无论是界面入口的整合优化,还是对用户反馈的快速响应,都表明团队正在努力提升产品的易用性。
虽然目前该语音功能仍处于小范围分批推送的灰度阶段,具体是否支持实时打断、连续深度追问等高级能力仍有待后续全量上线后检验,但可以确定的是,从“打字查资料”走向“自然语音对话”,代表了大模型融入大众日常生活的必然趋势。随着技术的持续迭代和功能的全面开放,更自然、高效的交互方式将进一步释放大模型的实际应用价值。