快讯
Google发布Gemini 3.5 Transcribe
Google发布Gemini 3.5 Transcribe语音转文本模型,提供实时流式和录音文件两种API,并支持超过85种语言。
Google发布Gemini 3.5 Transcribe语音转文本模型,并通过Gemini API和企业代理平台提供公开预览。
模型分别通过gemini-3.5-transcribe-live处理实时流式语音,通过gemini-3.5-transcribe处理预录音频,支持说话人识别、词级时间戳及超过85种语言。
参考:Google官方公告