跳到主要内容
模型发布

Google DeepMind发布 Gemini 3.5 Transcribe 语音转文字模型

来源:Google DeepMind · deepmind.google

更新摘要

Google DeepMind发布 Gemini 3.5 Transcribe,面向实时语音交互提供语音转文字能力。该模型支持 Live API 的双向流式转写,以及通过 Interactions API 处理录音,并提供说话人识别、词级时间戳、自定义词汇和超过 85 种语言支持。

本页仅索引并客观转述公开信息,产品能力、价格与可用范围以官方原文为准。