产品功能
Google 上线 Gemini 3.5 Transcribe,支持 85+ 语言自动识别
Google 在 AI Studio、API 及 macOS 版 Gemini Desktop 推出新版转写功能,开箱即…
2026.08.27 · 周四约 2 分钟阅读
Google 近期在 AI Studio、API 以及 macOS 版 Gemini Desktop 中上线了名为 Gemini 3.5 Transcribe 的语音转写功能,主打开箱即用的多语言自动识别能力。据 TestingCatalog 在 X 平台披露的消息,该功能支持「85+ 种语言自动检测」,开发者无需手动指定语种即可完成转写。
上线渠道与可用范围
根据 TestingCatalog 的帖子,Gemini 3.5 Transcribe 已同时覆盖三类入口:
- Google AI Studio 网页端
- Gemini API(面向开发者调用)
- Gemini Desktop for macOS(桌面客户端)
三端同步铺开意味着既覆盖了需要快速试验的开发者,也照顾到了本地化使用场景。
核心卖点:多语言自动识别
此次更新的最大亮点是「85+ 语言自动检测」能力。也就是说,当输入一段包含未知语种或混合语种的音频时,模型可以自行判断语言种类并完成转写,减少了开发者在前处理阶段的工作量。这对跨国业务、多语种客服、会议记录等场景具有直接价值。
信息来源与待验证点
需要指出的是,本次消息来自 X 上的资讯类账号 TestingCatalog,并非 Google 官方博客或发布会披露。原帖中也仅提及「85+ 语言」这一个量化数字,没有公布具体的模型规格、延迟、错误率(WER)等 benchmark 数据,也没有说明该能力是建立在已有 Gemini 2.5 Flash 语音模型之上,还是引入了新的专用模型。
此外,「Gemini 3.5 Transcribe」这一命名目前在 Google 官方渠道中尚无对应公告,社区对该编号的解读存在差异。在官方文档或博客进一步确认之前,相关名称与能力细节应以 Google 后续发布的正式信息为准。
