Tavus 发布 Griffin:近半数受试者在通话中将其误认为真人
Tavus 推出名为 Griffin 的“人类交互模型”(HIM),旨在实时理解和进行面对面视频对话。在一项研究中,48% 的参与者在仅一分钟的视频通话后认为 Griffin 是真人,而此前系统的最高比例仅为 2%。
Tavus 推出名为 Griffin 的“人类交互模型”(HIM),旨在实时理解和进行面对面视频对话。在一项研究中,48% 的参与者在仅一分钟的视频通话后认为 Griffin 是真人,而此前系统的最高比例仅为 2%。
Google DeepMind 正式发布 Nano Banana 2 Lite 和 Gemini Omni Flash,并在 Google AI Studio、Gemini API 及 Gemini Enterprise Agent Platform 向开发者开放。
推荐理由:官方同步开放两款新模型的开发者接口,明确了各自的延迟、成本及能力边界,为构建图文视频混合工作流提供了具体选型依据。
Google DeepMind 推出 Gemini Omni Flash,这是 Omni 系列的首个模型,支持从图像、音频、视频和文本等任意输入生成高质量视频。
推荐理由:原文详细说明了 Gemini Omni Flash 支持自然语言对话式视频编辑及多模态输入生成,并给出了具体的分发渠道和订阅权限。
Overworld 发布新一代实时视频世界模型 Waypoint-1.5,旨在让交互式生成世界能在用户现有的消费级硬件上运行。该模型提供两个版本:720p/60 FPS 版本适用于 RTX 3090 至 5090 等高性能桌面显卡,360p 版本则针对游戏笔记本及即将支持的 Apple Silicon Macs 优化以覆盖更广泛的设备。
推荐理由:原文给出了在消费级硬件上运行实时交互世界模型的具体参数与双版本策略,读者可据此评估本地部署的可行性。