
谷歌发布最高质量音频模型Gemini 3.1 Flash Live,低延迟、高精度响应,打造实时语音交互新范式
在生成式AI竞争加速向“实时交互”演进之际,谷歌正式推出Gemini 3.1 Flash Live模型。这一主打音频与语音实时能力的新模型,不仅强化低延迟对话体验,还进一步扩展至开发者生态,标志着Gemini体系正从“多模态理解”迈向“实时智能代理”的关键一步。 谷歌将Gemin...
Google 在 AI 方向最近有哪些新动作
Google 的产品动作、模型进展、组织变化和业务信号,会优先收拢在这里。
如果你想持续跟踪 Google 在 AI 方向的节奏,这一页会更直观。
Google资讯
1,405
正文图片
4,219

在生成式AI竞争加速向“实时交互”演进之际,谷歌正式推出Gemini 3.1 Flash Live模型。这一主打音频与语音实时能力的新模型,不仅强化低延迟对话体验,还进一步扩展至开发者生态,标志着Gemini体系正从“多模态理解”迈向“实时智能代理”的关键一步。 谷歌将Gemin...

微软与谷歌周四同步发布新一代AI模型,进一步加码多模态能力布局。微软推出自研MAI系列基础模型,覆盖语音转写、语音生成和图像生成,并加速融入自家产品体系;谷歌则发布Gemma 4开源模型,主打本地运行和多模态能力,并将许可切换至更开放的Apache 2.0协议。 微软推出的“世界...

谷歌近日发布了一份报告,称其安全研究团队 首次 发现黑客利用人工智能技术开发出了一款能够绕过广泛使用的计算机管理软件的攻击工具。这一发现引发了对网络安全新威胁的广泛关注。 根据报告,这款由网络犯罪团伙制造的工具可以利用一种 “零日” 漏洞进行攻击。所谓 “零日” 漏洞,是指开发商...

Google 日前宣布对 Gemini API 中的文件搜索功能进行重大升级,旨在为开发者提供更完善的多模态检索增强生成(RAG)能力。此次更新不仅打破了传统文本检索的局限,更将 AI 的理解维度扩展到了图像与复杂文档的深度整合,标志着企业级 AI 应用在信息检索准确性上迈出了关...

"试验阶段结束了。" Google Cloud CEO Thomas Kurian 在开场不到三分钟就抛出这句话。 Google Cloud Next 大会于当地时间4月22日上午在拉斯维加斯召开。这是近年来科技圈最受关注的云计算大会之一,今年的主角只有一个: Agent 。 从...