根据该媒体测试生成的,Muse Video 在细节呈现、对场景和物体关系的理解,以及连续画面在时间维度上的稳定性方面,展现出较高潜力。
Meta 此前承认模型仍存在音频与画面同步不足的问题,对高速运动的物理准确性也有差距。现有样本为 10 秒片段,尚不足以验证模型在更长时长叙事、复杂角色持续一致性或高强度动作场景中的稳定表现。
根据该媒体测试生成的,Muse Video 在细节呈现、对场景和物体关系的理解,以及连续画面在时间维度上的稳定性方面,展现出较高潜力。
Meta 此前承认模型仍存在音频与画面同步不足的问题,对高速运动的物理准确性也有差距。现有样本为 10 秒片段,尚不足以验证模型在更长时长叙事、复杂角色持续一致性或高强度动作场景中的稳定表现。