PixVerse 6 图生视频: 图像转视频

使用 PixVerse V6 将任意图像制作成视频。支持最高 1080p 分辨率、最长 15 秒时长,以及基于提示词的运动控制。

📝

概览

关于此模型

PixVerse V6 图生视频可在文本提示词引导下,将任意静态图像制作成高质量视频。支持最高 1080p 分辨率、最长 15 秒时长、提示词优化模式以及可选的 AI 生成音频。

1摄影:通过自然运动让人像和风景焕发生机。
2电子商务:将产品照片制作成动态展示视频。
3社交媒体:将单张照片转化为可分享的视频片段。
4创意制作:使用自定义运动提示词为艺术作品、插画或概念图添加动画。
💰

价格与价值

成本分析

muapiapp起价 $0.033/秒 (360p, no 音频) to $0.150/秒 (1080p, with 音频)

Per-second 定价. Default 720p without audio: $0.059/s.

Fal.ai暂不可用

PixVerse V6 image-to-video is 不可用 on Fal.ai.

Replicate暂不可用

PixVerse V6 image-to-video is 不可用 on Replicate.

** 竞品价格根据相似模型架构和使用层级估算。

⚙️

技术详情

配置参数

提示词string

所需视频运动和内容的文本描述。

默认值Cracks spread across the statue as it suddenly comes to life. Stone pieces fall off while glowing energy emerges from inside. The statue pulls itself free from the sand and takes a heavy step forward, shaking the ground as dust rises into the air.
图像 URLarray

Upload or provide the 输入图像 to animate.

默认值https://d3adwkbyhxyrtq.cloudfront.net/webassets/videomodels/pixverse-v6-i2v.mp4
分辨率枚举(4 个选项)

输出视频的分辨率。

默认值720p
时长(秒)int

视频时长(秒)。

默认值5
提示词优化枚举(3 个选项)

控制提示词增强。'enabled' 会重写提示词,'disabled' 按原样使用,'auto' 由模型决定。

默认值auto
生成音频boolean

Enable AI-生成的音频 for the video.

默认值false
📖

实施指南

开发者文档

如何使用 PixVerse V6 图生视频

  1. 提供图像:通过 images_list 字段上传或链接单个图像 URL。

  2. 编写运动提示词:描述你希望出现的运动,例如镜头平移、主体移动或环境变化等。

  3. 选择分辨率和时长:选择所需的输出质量(360p–1080p)和长度(1–15 秒)。

  4. 设置提示词优化:使用 thinking_type: auto 让模型决定是否增强提示词;使用 enabled 始终增强;使用 disabled 按原样使用提示词。

  5. 启用音频(可选):切换 generate_audio_switch,添加 AI 生成的环境声。

  6. 提交并轮询:API 返回 request_id。轮询 GET /api/v1/predictions/{request_id}/result,直到状态为 completed

常见问题

常见问答

可以提供多少张图像?

必须通过 images_list 字段提供且只能提供一个图像 URL。

thinking_type 有什么作用?

它控制提示词优化。'enabled' 会重写你的提示词以改善运动质量,'disabled' 会完全按照你写的提示词使用,而 'auto' 会让模型根据上下文自行决定。

费用如何计算?

费用按生成视频的秒数计算,并随分辨率变化。生成音频还会按秒收取附加费用。

支持哪些图像格式?

支持任何可公开访问的图像 URL。常见格式包括 JPEG、PNG 和 WebP。