跳到正文

技术方向

AI 视频 最新动态

AI 视频生成与理解:文生视频模型、视频编辑工具与影视创作变革的追踪。

1 条精选近 30 天 1 条共收录 1 条

更新

AI 视频的精选

9月25日周五第 1–1 条
  1. Google DeepMind63

    Google DeepMind 发布 Gemini 3.8 Live 实时虚拟形象功能

    Google DeepMind 发布 Gemini 3.8 Live 的 Live Avatar 功能,将实时视频生成与语音对话深度融合,支持精确唇形同步、自然表情和流畅话轮转换,可同时处理视觉与音频输入。该功能通过异步工具调用在后台执行复杂任务并保持对话连贯,支持 97 种语言的实时切换,SynthID 水印嵌入音视频输出以保障内容可溯源性,即日起面向 Gemini Enterprise 开放。

    推荐理由:原文披露了实时视觉对话、异步工具调用、97语言无缝切换等具体能力差异,以及 SynthID 水印的安全设计,读者可据此评估该功能对现有企业服务的补充方向。