近日,部分用户在使用DeepSeek应用时发现,该应用正在进行一项语音对话功能的灰度测试。有用户反馈,在应用界面的右上角新增了一个小喇叭图标,点击后即可开启语音交互模式。
在设置页面的语音选项中,用户可以自定义朗读音色,目前提供四种风格供选择:贝壳音色以百变活泼为特点,白浪音色呈现明朗坚定的特质,海星音色主打俏皮甜美的风格,暗潮音色则具有低沉浑厚的表现力。这种多样化的音色设计,能够满足不同场景下的使用需求。
与此同时,DeepSeek官方宣布推出全新模型架构下的最小尺寸模型——V4.1 Flash。该模型具备原生多模态视觉理解能力,在架构设计上着重优化了三个核心指标:通过算法改进提升能力上限,采用并行计算技术加快推理速度,运用资源调度策略扩大吞吐容量。这种设计使得模型既保持轻量化特征,又为后续扩展更大参数规模预留了技术空间。
在性能验证环节,V4.1 Flash模型在多项基准测试中展现出显著优势。测试数据显示,该模型在综合智能评估中超越了包括V4 Pro在内的多个旗舰级模型,特别是在多模态交互场景下,其响应准确率和处理效率均有明显提升。这种性能突破主要得益于新架构对视觉信号与语言信息的协同处理机制进行了优化。
关于功能扩展计划,开发团队透露正在测试语音交互与视觉理解的融合应用。未来用户可能通过语音指令调用图像识别功能,或者让系统同时处理语音和视觉双重输入。这种多模态交互模式将进一步拓展人工智能的应用边界,为智能助手类产品提供新的发展思路。
目前语音对话功能仍处于限量测试阶段,仅对部分用户开放体验。开发团队表示将根据测试反馈持续优化音色表现和交互流畅度,同时收集多模态数据用于改进模型性能。正式版本预计将在完成稳定性验证后逐步向全体用户推送。











