Gemini 3.5 Live Translate Preview 是 Google DeepMind 推出的 音频输入 · 语音合成模型,上下文窗口 16,384 tokens,单次最大输出 32,768 tokens。
原厂描述:Low-latency audio-to-audio model for real-time speech translation across 70+ languages
gemini-3.5-live-translate-preview数据来源:models.dev。
评论区
该文章暂未开放评论功能。