视频 API 已上线11 个端点

FLUX 3 API — Black Forest Labs 图像、视频与音频 API

FLUX 3 是 Black Forest Labs 统一的多模态模型家族,在图像、视频和音频数据上联合训练。其已上线的视频端点提供物理一致的运动,以及可选的原生同步音频。FLUX 3 的图像、Dev 和 Omni 变体即将推出。Muapi 会在开放通用访问后启用每个端点,现有用户无需重新注册。

已上线的 FLUX 3 端点视频生成、延长、草稿模式与放大7 个端点
文生视频已上线
已上线端点

FLUX 3 文本转视频

支持可选原生同步音频和物理一致运动的电影感文本转视频。

720p–1080p
$0.25–$0.42/sec
试用模型
文生视频已上线
已上线端点

FLUX 3 文本转视频草稿版

用于构思、分镜和提示词迭代的快速低成本草稿模式。

720p快速
$0.09/sec
试用模型
图生视频已上线
已上线端点

FLUX 3 图像转视频

将静态图像制作成电影感视频,同时保持与源图像一致的物理运动。

720p–1080p
$0.25–$0.42/sec
试用模型
图生视频已上线
已上线端点

FLUX 3 起止帧转视频

在指定的起始帧和结束帧之间生成可控过渡,并支持可选原生音频。

720p–1080p
$0.25–$0.42/sec
试用模型
延长已上线
已上线端点

FLUX 3 视频延长

通过提示词引导运动和场景发展,延续已有视频,并支持可选原生同步音频。

720p–1080p
$0.25–$0.42/sec
试用模型
延长已上线
已上线端点

FLUX 3 视频延长草稿版

在使用最终质量的 Video Extend 端点前,用快速低成本模式测试连续性。

720p快速
$0.09/sec
试用模型
放大已上线
已上线端点

FLUX 3 视频放大器

放大 FLUX 3 或其他视频输出,同时保持运动连贯性和音频同步。

Up to 4×
$1.43–$2.00/run
试用模型
即将推出图像、Dev 与 Omni Reference 变体4 个端点
文生图即将推出
即将推出

FLUX 3 文本转图像

旗舰级文本转图像生成,相比早期 FLUX 图像模型具有更清晰的细节和更强的提示词遵循能力,即将推出。

Up to 4K
TBD
View Details
编辑即将推出
即将推出

FLUX 3 图像转图像

基于 FLUX 3 统一架构、支持最多四张参考图像的指令驱动图像编辑,即将推出。

Up to 4K
TBD
View Details
文生图即将推出
即将推出

FLUX 3 Dev

更快、更低成本的 FLUX 3 变体,计划于 2026 年晚些时候开放权重,即将推出。

Up to 4K快速
TBD
View Details
Omni即将推出
即将推出

FLUX 3 Omni

使用多张图像和视频参考进行生成,并保持主体、风格和场景一致,即将推出。

Up to 4K
TBD
View Details

什么是 FLUX 3?

FLUX 3 是 Black Forest Labs 于 2026 年 7 月公布的新一代前沿模型,在图像、视频和音频数据上联合训练为统一的多模态系统,并可扩展到动作预测。相比只面向图像的 FLUX Kontext,它对现实世界的光照、运动和物理规律有更强的理解。

Muapi 的 FLUX 3 视频 API 已上线。文本转视频、图像转视频、起止帧转视频、视频延长、草稿模式和视频放大共享统一的异步 REST 生命周期;图像、Dev 与 Omni 变体将在开放后加入。

主要能力

统一的图像、视频与音频

一个在图像、视频和音频数据上联合训练的架构,并可进一步用于机器人动作预测。

原生同步音频

已上线的 FLUX 3 视频端点可以生成与视频同步的场景音频,无需单独执行 TTS。

物理一致的运动

生成视频中的运动、光照和物体行为保持现实世界的物理一致性。

指令驱动的编辑

计划中的 FLUX 3 图像转图像端点支持最多四张参考图像和文字指令。

更快的 Dev 变体

计划中的 Dev 版本以少量峰值保真度换取更低延迟和成本,预计 2026 年晚些时候开放权重。

最高 4K 图像输出

FLUX 3 Image 预计支持最高 4K 输出,延续 FLUX 家族的高分辨率方向。

视频延长

Video Extend 使用提示词引导运动和场景发展,延续已有片段。

起止帧控制

Start-End to Video 控制用户提供的两帧之间的过渡。

视频放大

Video Upscaler 在保持运动连贯性和音频同步的同时提升视频分辨率。

快速草稿模式

Text to Video Draft 和 Video Extend Draft 在提示词迭代期间降低成本与延迟。

Omni Reference

计划中的 Omni 模式通过多张图像与视频参考保持主体、风格和场景一致。

Muapi 上的 FLUX 3 变体

变体模态分辨率适合场景状态
FLUX 3 文本转图像图像最高 4K旗舰级图像生成即将推出
FLUX 3 文本转视频视频 + 音频720p–1080p带原生音频的电影感片段已上线
FLUX 3 图像转视频视频 + 音频720p–1080p物理一致的图像动画已上线
FLUX 3 视频延长视频 + 音频720p–1080p延续已有片段已上线
FLUX 3 Omni图像 + 视频最高 4K多参考一致性即将推出

FLUX 3 视频 API

使用 Muapi API 密钥提交生成请求,保存返回的 request ID,并轮询标准预测结果端点。所有已上线的 FLUX 3 视频端点都使用相同生命周期。

提交视频生成任务

curl -X POST https://api.muapi.ai/api/v1/flux-3-text-to-video \
  -H "x-api-key: YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"prompt":"A cinematic aerial shot of mist moving through a mountain valley at sunrise.","resolution":"720p","duration":5}'

# Response: {"request_id":"REQUEST_ID"}

根据工作流选择文本转视频、图像转视频、起止帧转视频或视频延长,并提交对应输入字段。

获取已完成结果

curl https://api.muapi.ai/api/v1/predictions/REQUEST_ID/result \
  -H "x-api-key: YOUR_API_KEY"

# When status is completed, read the generated media URL from outputs.

轮询直到状态变为 completed,然后从响应中读取生成的媒体 URL。

常见问题

什么是 FLUX 3?

FLUX 3 是 Black Forest Labs 的多模态前沿模型,在统一架构中联合训练图像、视频和音频,并可扩展到动作预测。

现在可以使用 FLUX 3 API 吗?

FLUX 3 视频 API 已在 Muapi 上线,包括文本转视频、图像转视频、起止帧转视频、视频延长、视频放大和快速草稿模式。图像、Dev 与 Omni 变体即将推出。

Muapi 提供哪些 FLUX 3 变体?

Muapi 列出 11 个端点:7 个已上线的视频相关端点,以及 4 个即将推出的图像、Dev 和 Omni 变体。

FLUX 3 与 FLUX.2、FLUX Kontext 有什么区别?

FLUX.2 和 FLUX Kontext 主要面向图像;FLUX 3 统一了图像、视频和音频生成,并增加原生同步音频和更强的现实运动一致性。

FLUX 3 会开放权重吗?

Black Forest Labs 表示更快的开放权重版本将在 2026 年晚些时候推出,Dev 变体是计划中的低成本路径。

FLUX 3 Omni 是什么?

Omni Reference 是计划中的多参考模式,可以根据多张图像和视频参考生成内容,同时保持主体与风格一致。

FLUX 3 视频 API 如何计费?

主要视频端点在 720p 下按每秒 $0.25、1080p 下按每秒 $0.42 计费;草稿模式为每秒 $0.09;视频放大每次约 $1.43–$2.00。

如何通过 Muapi 开始使用 FLUX 3?

创建 Muapi 账户和 API 密钥,然后调用任一已上线端点。即将推出的端点开放后会为现有用户启用。

准备开始使用 FLUX 3 了吗?

从已上线的视频端点开始,并为图像和 Omni 版本保持同一套集成。