谷歌推出Gemini 3.8 Live与Extended Thinking,称其为迄今最先进实时对话模型

当地时间9月15日,谷歌宣布推出Gemini 3.8 Live和Gemini 3.8 Live Extended Thinking。谷歌称,这是迄今最先进的实时对话模型,在智能和并行推理方面均有显著提升。

其中,Gemini 3.8 Live面向规模部署与成本优化,兼顾对话智能、流畅交流和视觉理解;Gemini 3.8 Live Extended Thinking则瞄准高复杂度任务,具备更强的智能和多步推理能力。

在多项基准测试中,Gemini 3.8 Live Extended Thinking以82.6%位列Artificial Analysis语音对语音质量指数第一名。

其在τ-Voice智能体任务完成率为68.6%,在Sierra的τ-Voice-banking基准测试达35.1%;推理能力方面,Big Bench Audio得分为97.7%,同时保持有竞争力的定价。

Gemini 3.8 Live可近实时处理视觉输入,在对话中自动检测并切换97种支持的语言,并可在后台执行工具与API调用,同时保持对话流畅不中断。

开发者可通过Gemini Live API,在声网、Fishjam、LiveKit、Pipecat、Vercel、Vision Agents等平台构建高性能语音驱动界面。谷歌还与Salesforce、Genspark、Lumeris等企业开展合作。

谷歌对AI生成的音频嵌入SynthID隐形水印,可直接检测AI生成内容,帮助防止虚假信息传播。Gemini 3.8 Live已开始推送,开发者可在Gemini API和Google AI Studio使用。

市场有风险,投资需谨慎。本文为AI基于第三方数据生成,仅供参考,不构成个人投资建议。

财经频道更多独家策划、专家专栏,免费查阅>>

责任编辑:栎树
AI智能分析该文,为您挖掘投资机会该AI功能处于试用阶段,内容仅供参考,请仔细甄别!
展开
精彩推荐
加载更多
全部评论
热榜
关闭 下载金融界app
金融界App
金融界微博
金融界公众号