新芒xAI 9月14日消息,DeepSeek正在部分App用户中灰度测试语音交互功能。获得测试资格的用户可在页面右上角看到扬声器入口,设置页面也会出现“朗读音色”选项,目前提供四种音色选择。
关键要点
从已出现的界面看,此次更新至少覆盖语音播放和音色切换,使用户能够用声音接收模型回答。由于功能仍处于灰度阶段,不同账号和设备的开放情况可能存在差异,全面上线时间、支持平台和使用限制尚未明确。
现有信息还不足以确认该功能是否已经支持全双工实时对话、随时打断、情绪表达和低延迟连续交流。页面中的“朗读音色”更接近文本转语音能力,因此在官方公布完整说明前,不宜把它直接等同于成熟的实时语音助手。
语音入口可降低驾驶、家务和移动场景中的输入成本,也能提升长文本内容的可访问性。但语音数据是否保存、是否用于改进服务、敏感内容如何处理,以及公共场所播放带来的隐私问题,仍需要更清晰的产品说明。
新芒xAI评论
对移动端用户而言,语音的价值在于把AI从需要持续注视屏幕的工具,变成可在碎片化场景中调用的服务。即使首轮能力主要是朗读,只要延迟和自然度可接受,也能提高知识问答、内容学习和无障碍使用的便利性。
对DeepSeek而言,增加语音意味着竞争开始从模型性能延伸到高频交互入口。真正决定用户留存的不会只是音色数量,而是识别准确率、响应速度、打断能力、上下文连续性,以及在复杂环境中的稳定性。
现阶段更合理的判断是,DeepSeek正在补齐声音输出与语音交互能力,而非已经完成语音智能体。后续若进一步开放双向实时对话、工具调用和跨设备连续任务,语音才可能从辅助功能升级为新的主要入口。