Jelajahi dan integrasikan model AI volcengine-video-to-video-lip-sync melalui MuAPI. Dapatkan inferensi berkecepatan tinggi dan harga kompetitif.
About this model
Model volcengine-video-to-video-lip-sync menyediakan kemampuan generasi AI mutakhir di platform MuAPI.
Cost analysis
| Provider | Cost | Notes |
|---|---|---|
| muapiapp | $0.06/sec of audio (1.3× margin applied) | Pay-per-generation, no subscription required. |
| Fal.ai | Tidak tersedia | Fal.ai does not offer this specific model. |
| Replicate | Tidak tersedia | Replicate does not offer this specific model. |
Pay-per-generation, no subscription required.
Fal.ai does not offer this specific model.
Replicate does not offer this specific model.
** Competitor pricing is estimated based on similar model architectures and usage tiers.
Configuration schema
| Parameter | Type | Description | Default |
|---|---|---|---|
| Mode | Enum (2 options) | 服务模式。'lite' 用于单人正面Video,处理速度更快;'basic' 用于单人复杂场景,并Mendukung场景分割和说话人识别。 | lite |
| Video URL | string | Video URL。Mendukung的Resolusi:360p-1080p。高于 1080p 的Video会压缩为 1080p;不Mendukung低于 360p 的Video。Mendukung的格式:MOV、MP4、HDR。文件最大为 500MB。 | https://d3adwkbyhxyrtq.cloudfront.net/muapi/data/volcengine-lipsync-video.mp4 |
| Audio / Suara URL | string | 用于驱动Video口型动作的纯人声Audio URL。文件最大为 10MB。 | https://d3adwkbyhxyrtq.cloudfront.net/muapi/data/volcengine-lipsync-audio.mp3 |
| 分离人声 | boolean | 启用人声分离以抑制背景噪声。 | false |
| 场景检测 | boolean | 启用场景分割和说话人识别。仅Mendukung Basic 模式。 | false |
| 对齐Audio / Suara(循环Video) | boolean | Mendukung Lite 模式。当Audio长于Video时是否循环Video。 | true |
| 反向对齐Audio / Suara | boolean | Mendukung Lite 模式。是否反向循环Video。要求 align_audio 为 true。 | false |
| 模板开始秒数 | int | Supported in Lite mode. Start time of the template video, in seconds. | 0 |
服务模式。'lite' 用于单人正面Video,处理速度更快;'basic' 用于单人复杂场景,并Mendukung场景分割和说话人识别。
liteVideo URL。Mendukung的Resolusi:360p-1080p。高于 1080p 的Video会压缩为 1080p;不Mendukung低于 360p 的Video。Mendukung的格式:MOV、MP4、HDR。文件最大为 500MB。
https://d3adwkbyhxyrtq.cloudfront.net/muapi/data/volcengine-lipsync-video.mp4用于驱动Video口型动作的纯人声Audio URL。文件最大为 10MB。
https://d3adwkbyhxyrtq.cloudfront.net/muapi/data/volcengine-lipsync-audio.mp3启用人声分离以抑制背景噪声。
false启用场景分割和说话人识别。仅Mendukung Basic 模式。
falseMendukung Lite 模式。当Audio长于Video时是否循环Video。
trueMendukung Lite 模式。是否反向循环Video。要求 align_audio 为 true。
falseSupported in Lite mode. Start time of the template video, in seconds.
0Developer documentation
Panduan integrasi cepat untuk volcengine-video-to-video-lip-sync. Hubungkan dengan kunci API MuAPI Anda dan mulai lakukan panggilan inferensi.
Frequently asked
它接收现有视频和目标音轨,然后重新生成说话人的嘴部动作,使其匹配新音频,适合在无需重新拍摄的情况下为素材配音或重新配声。
`lite` 模式针对单人、正面镜头的视频进行了优化,处理速度更快。`basic` 模式支持更复杂的场景,包括通过 `open_scenedet` 进行场景分割和说话人识别。
视频:MOV、MP4 或 HDR,360p–1080p 分辨率(高于 1080p 会压缩到更低分辨率),最大 500MB,24–60fps,1–30 Mbps 比特率。音频:MP3、WAV、AAC、MP4-audio 或 OGG,最大 10MB。
输出时长始终跟随音频。如果视频短于音频,视频会循环(`align_audio`),也可以选择反向循环(`align_audio_reverse`)来填补差额。如果视频更长,则会裁剪到音频时长。
启用后,它会对输入音频执行人声分离,在用音频驱动唇形动作前抑制背景音乐或噪声,从而提高嘈杂音轨上的同步准确度。
生成的视频以 25fps 的 MP4 返回,分辨率与输入视频一致,最高为 1080p。