漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品

Meta 旗下的 Muse Video 视频生成模型已进入封闭测试阶段。根据曝光的早期生成样片,该模型在 10 秒级视频中展现出较高的细节还原能力、对场景的理解能力以及时间一致性,并且原生支持音频生成。这意味着 Muse Video 不再是单纯的无声画面生成,而是在画面连续性与音画同步方面同步推进。当前 AI 视频生成领域的竞争焦点正从“能否生成”转向“生成得稳不准、是否可控”,原生音频与长时序一致性是行业公认的技术难点。Muse Video 若能在封闭测试中验证这些能力,将有助于 Meta 在生成式视频赛道中建立更完整的多模态内容创作工具,也为后续开放测试和产品化提供基础。

核心要点

  • Meta Muse Video 视频模型已进入封闭测试,早期样片显示细节、世界理解与时间一致性较强
  • 模型原生支持音频生成,并可在测试中产出 10 秒长视频
  • 原生音频与长时序一致性是当前 AI 视频生成领域的关键竞争方向

Read more >