LTX 2.3 唇形同步: AIリップシンク

LTX-2.3 LipSync 可将嘴部动作与入力音频片段同步,生成逼真的说话视频。它会保留面部身份、头部位置、光照和自然表情,同时呈现准确的唇部运动、细微眨眼和稳定的时间一致性,由升级的 LTX-2.3 架构提供。

📝

概要

このモデルについて

LTX-2.3 LipSync 可通过将嘴部动作与入力音频片段同步,生成逼真的说话视频。它会保留面部身份、头部位置、光照和自然表情。

1AI 数字化身
2视频配音
3对白替换
4角色旁白
💰

料金と価値

コスト分析

muapiapp$0.26 avg

基于 1.3 倍系数

** 競合サービスの料金は類似のモデル構成および利用ティアに基づいて算出された推定値です。

⚙️

技術詳細

設定スキーマ

プロンプトstring

Optional prompt to guide lipsync generation.

デフォルト値Animate natural lip-sync to the provided audio, add subtle blinking and gentle head motion, maintain the original lighting and facial identity.
画像 URLstring

入力人像画像的 URL。

デフォルト値https://d3adwkbyhxyrtq.cloudfront.net/webassets/videomodels/ltx-2.3-lipsync.png
音声 URLstring

URL of the input audio file.

デフォルト値https://d3adwkbyhxyrtq.cloudfront.net/webassets/videomodels/ltx-2.3-lipsync.wav
解像度Enum(3個の選択肢)

生成動画的解像度。

デフォルト値720p
种子int

ランダムシード値。-1 表示随机。

デフォルト値-1
📖

実装ガイド

開発者ドキュメント

提供清晰的人像图像和高质量音频文件。你还可以提供プロンプト,用于指导细微的面部表情和头部运动。

よくある質問

FAQ

音频片段最长可以多长?

目前支持最长 20 秒的音频片段。