模型发布
Google DeepMind发布 Gemini 3.5 Transcribe 语音转文字模型
来源:Google DeepMind · deepmind.google
更新摘要
Google DeepMind发布 Gemini 3.5 Transcribe,面向实时语音交互提供语音转文字能力。该模型支持 Live API 的双向流式转写,以及通过 Interactions API 处理录音,并提供说话人识别、词级时间戳、自定义词汇和超过 85 种语言支持。
本页仅索引并客观转述公开信息,产品能力、价格与可用范围以官方原文为准。