LTX-2.3 LipSync 可将嘴部动作与入力音频片段同步,生成逼真的说话视频。它会保留面部身份、头部位置、光照和自然表情,同时呈现准确的唇部运动、细微眨眼和稳定的时间一致性,由升级的 LTX-2.3 架构提供。
このモデルについて
LTX-2.3 LipSync 可通过将嘴部动作与入力音频片段同步,生成逼真的说话视频。它会保留面部身份、头部位置、光照和自然表情。
コスト分析
| プロバイダー | 費用 | 備考 |
|---|---|---|
| muapiapp | $0.26 avg | 基于 1.3 倍系数 |
基于 1.3 倍系数
** 競合サービスの料金は類似のモデル構成および利用ティアに基づいて算出された推定値です。
設定スキーマ
| パラメータ | 型 | 説明 | デフォルト |
|---|---|---|---|
| プロンプト | string | Optional prompt to guide lipsync generation. | Animate natural lip-sync to the provided audio, add subtle blinking and gentle head motion, maintain the original lighting and facial identity. |
| 画像 URL | string | 入力人像画像的 URL。 | https://d3adwkbyhxyrtq.cloudfront.net/webassets/videomodels/ltx-2.3-lipsync.png |
| 音声 URL | string | URL of the input audio file. | https://d3adwkbyhxyrtq.cloudfront.net/webassets/videomodels/ltx-2.3-lipsync.wav |
| 解像度 | Enum(3個の選択肢) | 生成動画的解像度。 | 720p |
| 种子 | int | ランダムシード値。-1 表示随机。 | -1 |
Optional prompt to guide lipsync generation.
Animate natural lip-sync to the provided audio, add subtle blinking and gentle head motion, maintain the original lighting and facial identity.入力人像画像的 URL。
https://d3adwkbyhxyrtq.cloudfront.net/webassets/videomodels/ltx-2.3-lipsync.pngURL of the input audio file.
https://d3adwkbyhxyrtq.cloudfront.net/webassets/videomodels/ltx-2.3-lipsync.wav生成動画的解像度。
720pランダムシード値。-1 表示随机。
-1開発者ドキュメント
提供清晰的人像图像和高质量音频文件。你还可以提供プロンプト,用于指导细微的面部表情和头部运动。
FAQ
目前支持最长 20 秒的音频片段。