谷歌推出 Gemini 3.8 Live:新增 Live Avatar 支持 97 种语言无缝切换
谷歌正式推出带 Live Avatar 功能的 Gemini 3.8 Live,为原生实时对话模型带来接近实时的视觉呈现。该功能支持 97 种语言无缝切换与异步工具调用,现已在 Gemini Enterprise 上线并向企业开放 API 接入。
SEARCH INTELLIGENCE
从最新动态到实用工具,找到你关心的内容。
谷歌正式推出带 Live Avatar 功能的 Gemini 3.8 Live,为原生实时对话模型带来接近实时的视觉呈现。该功能支持 97 种语言无缝切换与异步工具调用,现已在 Gemini Enterprise 上线并向企业开放 API 接入。
Google 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking,首次将实时语音模型拆分为面向规模化对话与复杂推理两个版本,并同步开放 API 与 Workspace 入口。
Google 于 2026-09-02 发布 Gemini 3.8 Flash 和 3.8 Flash Cyber,前者在长程编程基准测试中表现优于多数更大规模模型且定价不变,后者专攻网络安全,漏洞发现成功率超 70%。
Google Antigravity 的 Teamwork 框架结合 Gemini 3.7 Flash,支持多智能体在数小时至数天内协作,已在数学证明、系统仿真与开源代码优化领域取得具体成果。
Google 于 8 月 13 日发布 Gemini 3.7 Flash,在编程、网页开发与复杂文档处理等场景较上一代显著提升,API 输入价格降至 $0.75/百万 token,约为上一代原价的一半,新模型同步上线 Gemini Spark。
谷歌为Gemini平台的视频模型Veo 3.1推出多款新预设模板,强化用户通过照片或文本定制视频的能力。同时,图像生成功能“Nano Banana”引入两种模型,包括支持高级特性的Gemini 3 Pro Image。
OpenAI将GPT-5.2的发布时间从12月底提前至12月9日,源于谷歌Gemini 3模型带来的竞争压力。公司内部进入'红色警报'状态,并战略转向提升模型的速度、稳定性和可定制性。
谷歌发布Nano Banana Pro文生图模型升级版本,无缝整合Gemini 3 Pro多模态能力和Veo 3视频技术,实现复杂场景图像生成与跨语言文本渲染。新模型覆盖多层级用户生态,支持第三方工具集成,并通过SynthID水印技术强化安全验证。
谷歌发布Gemini 3人工智能模型,官方称其为迄今最智能模型和世界最佳多模态理解系统,首日即整合至核心产品。该模型在多项基准测试中刷新纪录,并推出Antigravity开发平台重构人机协作范式。
谷歌新一代AI大模型Gemini 3.0在代码生成和多模态创作领域实现显著突破,引发业界广泛关注。作为谷歌追赶AI市场的关键一步,其发布被视为重塑行业格局的契机,并获巴菲特43亿美元加仓支持。