桃子桃子快讯
返回首页
产品功能

DeepSeek 移动端朗读功能现四款可选语音

DeepSeek 移动应用被发现提供四种朗读语音,业界猜测其或将推出 TTS 新模型。

2026.09.12 · 周六2 分钟阅读

DeepSeek 移动应用近期被发现在其「朗读」功能中提供四种不同的可选语音,用户可以在应用内切换不同音色来播放文本内容。这一变化由 X 用户 TestingCatalog 在社交平台上首先注意到,并由此引发外界对 DeepSeek 是否即将推出自研 TTS(文本转语音)模型的讨论。

被发现的功能变化

据 TestingCatalog 发布的截图信息,DeepSeek 移动端的朗读界面已出现语音切换选项,用户可以试听并选择不同的声音来朗读回复内容。目前该功能仅在移动应用中可见,网页端或 API 端是否同步支持尚不明确。DeepSeek 官方尚未就此发布任何公告或博客说明。

是否预示新 TTS 模型

TestingCatalog 在帖文中以「Are we expecting new TTS models from DeepSeek soon?」作为结尾,表达了对其语音能力进一步扩展的推测。但截至目前,DeepSeek 公开的技术能力仍以文本大模型为主,并未对外披露任何 TTS 方向的论文、模型权重或技术博客。四款新语音究竟是来自第三方语音供应商的接入,还是自研语音模型的初步落地,仍有待官方确认。

厂商语音能力布局背景

近两年,多家主流大模型厂商陆续增强语音合成能力,支持多音色、情感控制与多语言朗读等功能。如果 DeepSeek 未来推出自研 TTS 模型,将与其现有文本模型形成更完整的多模态产品矩阵。不过,仅凭当前移动端 UI 的调整,尚不足以判断公司 TTS 路线的具体走向。

信源