Skip to main content
Kling 音频到视频口型同步节点可将视频文件中的嘴部动作与音频文件的音频内容同步。此节点会分析音频中的人声模式,并调整视频中的面部动作,以生成逼真的口型同步。该过程需要包含清晰可辨面部的视频,以及包含清晰可辨人声的音频文件。

输入

重要限制:
  • 音频文件不应大于 5MB
  • 视频文件不应大于 100MB
  • 视频尺寸的高度/宽度应在 720px 到 1920px 之间
  • 视频时长应在 2 秒到 10 秒之间
  • 音频必须包含清晰可辨的人声
  • 视频必须包含清晰可辨的面部

输出

本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑

Source fingerprint (SHA-256): 2f88af3191ac4f9c5c9fa1aaa5b744a12620b66e55a1fe0ab16b8b3b61110128