FLUX 3 文本转视频
支持可选原生同步音频和物理一致运动的电影感文本转视频。
FLUX 3 是 Black Forest Labs 统一的多模态模型家族,在图像、视频和音频数据上联合训练。其已上线的视频端点提供物理一致的运动,以及可选的原生同步音频。FLUX 3 的图像、Dev 和 Omni 变体即将推出。Muapi 会在开放通用访问后启用每个端点,现有用户无需重新注册。
支持可选原生同步音频和物理一致运动的电影感文本转视频。
用于构思、分镜和提示词迭代的快速低成本草稿模式。
将静态图像制作成电影感视频,同时保持与源图像一致的物理运动。
在指定的起始帧和结束帧之间生成可控过渡,并支持可选原生音频。
通过提示词引导运动和场景发展,延续已有视频,并支持可选原生同步音频。
在使用最终质量的 Video Extend 端点前,用快速低成本模式测试连续性。
放大 FLUX 3 或其他视频输出,同时保持运动连贯性和音频同步。
旗舰级文本转图像生成,相比早期 FLUX 图像模型具有更清晰的细节和更强的提示词遵循能力,即将推出。
基于 FLUX 3 统一架构、支持最多四张参考图像的指令驱动图像编辑,即将推出。
更快、更低成本的 FLUX 3 变体,计划于 2026 年晚些时候开放权重,即将推出。
使用多张图像和视频参考进行生成,并保持主体、风格和场景一致,即将推出。
FLUX 3 是 Black Forest Labs 于 2026 年 7 月公布的新一代前沿模型,在图像、视频和音频数据上联合训练为统一的多模态系统,并可扩展到动作预测。相比只面向图像的 FLUX Kontext,它对现实世界的光照、运动和物理规律有更强的理解。
Muapi 的 FLUX 3 视频 API 已上线。文本转视频、图像转视频、起止帧转视频、视频延长、草稿模式和视频放大共享统一的异步 REST 生命周期;图像、Dev 与 Omni 变体将在开放后加入。
一个在图像、视频和音频数据上联合训练的架构,并可进一步用于机器人动作预测。
已上线的 FLUX 3 视频端点可以生成与视频同步的场景音频,无需单独执行 TTS。
生成视频中的运动、光照和物体行为保持现实世界的物理一致性。
计划中的 FLUX 3 图像转图像端点支持最多四张参考图像和文字指令。
计划中的 Dev 版本以少量峰值保真度换取更低延迟和成本,预计 2026 年晚些时候开放权重。
FLUX 3 Image 预计支持最高 4K 输出,延续 FLUX 家族的高分辨率方向。
Video Extend 使用提示词引导运动和场景发展,延续已有片段。
Start-End to Video 控制用户提供的两帧之间的过渡。
Video Upscaler 在保持运动连贯性和音频同步的同时提升视频分辨率。
Text to Video Draft 和 Video Extend Draft 在提示词迭代期间降低成本与延迟。
计划中的 Omni 模式通过多张图像与视频参考保持主体、风格和场景一致。
| 变体 | 模态 | 分辨率 | 适合场景 | 状态 |
|---|---|---|---|---|
| FLUX 3 文本转图像 | 图像 | 最高 4K | 旗舰级图像生成 | 即将推出 |
| FLUX 3 文本转视频 | 视频 + 音频 | 720p–1080p | 带原生音频的电影感片段 | 已上线 |
| FLUX 3 图像转视频 | 视频 + 音频 | 720p–1080p | 物理一致的图像动画 | 已上线 |
| FLUX 3 视频延长 | 视频 + 音频 | 720p–1080p | 延续已有片段 | 已上线 |
| FLUX 3 Omni | 图像 + 视频 | 最高 4K | 多参考一致性 | 即将推出 |
使用 Muapi API 密钥提交生成请求,保存返回的 request ID,并轮询标准预测结果端点。所有已上线的 FLUX 3 视频端点都使用相同生命周期。
curl -X POST https://api.muapi.ai/api/v1/flux-3-text-to-video \
-H "x-api-key: YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{"prompt":"A cinematic aerial shot of mist moving through a mountain valley at sunrise.","resolution":"720p","duration":5}'
# Response: {"request_id":"REQUEST_ID"}根据工作流选择文本转视频、图像转视频、起止帧转视频或视频延长,并提交对应输入字段。
curl https://api.muapi.ai/api/v1/predictions/REQUEST_ID/result \ -H "x-api-key: YOUR_API_KEY" # When status is completed, read the generated media URL from outputs.
轮询直到状态变为 completed,然后从响应中读取生成的媒体 URL。
FLUX 3 是 Black Forest Labs 的多模态前沿模型,在统一架构中联合训练图像、视频和音频,并可扩展到动作预测。
FLUX 3 视频 API 已在 Muapi 上线,包括文本转视频、图像转视频、起止帧转视频、视频延长、视频放大和快速草稿模式。图像、Dev 与 Omni 变体即将推出。
Muapi 列出 11 个端点:7 个已上线的视频相关端点,以及 4 个即将推出的图像、Dev 和 Omni 变体。
FLUX.2 和 FLUX Kontext 主要面向图像;FLUX 3 统一了图像、视频和音频生成,并增加原生同步音频和更强的现实运动一致性。
Black Forest Labs 表示更快的开放权重版本将在 2026 年晚些时候推出,Dev 变体是计划中的低成本路径。
Omni Reference 是计划中的多参考模式,可以根据多张图像和视频参考生成内容,同时保持主体与风格一致。
主要视频端点在 720p 下按每秒 $0.25、1080p 下按每秒 $0.42 计费;草稿模式为每秒 $0.09;视频放大每次约 $1.43–$2.00。
创建 Muapi 账户和 API 密钥,然后调用任一已上线端点。即将推出的端点开放后会为现有用户启用。
从已上线的视频端点开始,并为图像和 Omni 版本保持同一套集成。