Google DeepMind 发布 Gemini 3.8 Live with Live Avatar
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在 Gemini 3.8 Live 的原生实时对话模型上加入近实时视频生成,让对话具备会听、会看、会说的动态视觉形象。
推荐理由:Gemini 3.8 Live 新增实时视频形象能力,读者可了解其多语言口型同步与后台工具调用如何用于企业对话场景。
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在 Gemini 3.8 Live 的原生实时对话模型上加入近实时视频生成,让对话具备会听、会看、会说的动态视觉形象。
推荐理由:Gemini 3.8 Live 新增实时视频形象能力,读者可了解其多语言口型同步与后台工具调用如何用于企业对话场景。
Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款语音生成模型,前者面向角色设计与逐句表演指导,后者面向高吞吐、低成本的配音与语音智能体场景。
推荐理由:两款 TTS 模型把语音生成从固定音色扩展到自然语言定制与逐句导演,并给出基准排名和开放入口。
Google DeepMind 发布两款实时语音对话模型 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking。
推荐理由:两款语音对话模型同时发布,给出了语音智能体基准成绩和开发者接入渠道,可据此判断实时语音 Agent 的可用性。
从一批信源里筛出值得看的动态,同一件事的多篇报道归到一起,每天出一份日报

每个都有独立入口、介绍与获取方式

121 篇文章 · 80 个资源包 · 11 个分类

按公司与模型、技术方向、内容形态追踪同一条线索

每日精编、每周回顾、每月盘点,可订阅 RSS

多上游统一入口、密钥分发、用量与计费控制台
我们在持续补充新的板块。这里会放上还没准备好的部分,敬请期待。