Google Gemini 3.8 Live 端到端语音模型亮相
DeepLearningAI 介绍,Google 的 Gemini 3.8 Live 模型采用语音到语音架构,在一个系统中完成聆听、推理和回应。推文称,Extended Thinking 版本在 Artificial Analysis 的 Speech to Speech Index 中排名第一;标准版在真人盲评现场对话中排名第二,输入音频价格为每小时 0.84 美元,为该指数最低。两个版本还支持图像和视频输入。
共 1 条快讯 · 门户最近更新
DeepLearningAI 介绍,Google 的 Gemini 3.8 Live 模型采用语音到语音架构,在一个系统中完成聆听、推理和回应。推文称,Extended Thinking 版本在 Artificial Analysis 的 Speech to Speech Index 中排名第一;标准版在真人盲评现场对话中排名第二,输入音频价格为每小时 0.84 美元,为该指数最低。两个版本还支持图像和视频输入。