Google Research 发布 AI 视频联合导演框架,实现连贯长视频生成
Google Research 发布 AI video co-director 多智能体框架,作为 Gemini 与 Veo 之上的编排层,将长视频生成建模为全局优化与世界状态跟踪问题,缓解语义漂移和级联失败。
推荐理由:Google 把长视频生成拆成四个可复用框架,读者可了解多智能体编排如何缓解语义漂移与级联失败。
Google Research 发布 AI video co-director 多智能体框架,作为 Gemini 与 Veo 之上的编排层,将长视频生成建模为全局优化与世界状态跟踪问题,缓解语义漂移和级联失败。
推荐理由:Google 把长视频生成拆成四个可复用框架,读者可了解多智能体编排如何缓解语义漂移与级联失败。
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在 Gemini 3.8 Live 的原生实时对话模型上加入近实时视频生成,实现带口型同步、自然表情和流畅轮次的视觉化对话。
推荐理由:官方给出 Live Avatar 的实时音视频对话能力、97 种语言切换与异步工具调用细节,可据此判断企业级多模态交互的落地形态。