Flux Dev

Flux-dev 是一个拥有 120 亿参数的整流流 Transformer 文本转図像モデル。

功能

flux-dev 是一个 120 亿参数的整流流 Transformer,可以根据文字説明生成図像。

核心功能

  • 高质量図像生成: 根据文本提示词生成细节丰富、視觉效果出色的図像。
  • 通过引导蒸馏実現高效训练: 使用引导蒸馏技术提升训练效率和モデル响应能力。
  • 开放权重: 开放モデル权重,方便科学研究和創意开発。
  • 用途灵活: 适合个人、科学和商业应用,在不同使用场景中都具有灵活性。

限制

  • 創意导向: 主要用于創意図像合成,不适合生成事実准确的内容。
  • 固有偏见: 输出可能反映训练数据中存在的偏见。
  • 输入敏感性: 生成図像的质量和一致性很大程度上取决于输入文本质量;细微变化可能导致输出不同。
  • 依赖提示词: モデル表現与提示词的清晰度和结构密切相関連,可能需要仔细编写提示词才能获得最佳结果。

不适用的用途

モデル及其衍生モデル不得以任何违反适用国家、联邦、州、地方或国际法律法规的方式使用,包括但不限于:

  • 剥削、伤害或试図剥削/伤害未成年人,包括招揽、制作、获取或传播儿童剥削内容。
  • 以伤害他人として目的生成或传播可验证的虚假信息。
  • 創建或传播可能被用于伤害个人的个人可识别信息。
  • 骚扰、虐待、威胁、跟踪或欺凌个人或群体。
  • 制作未経同意的裸体或非法色情内容。
  • 做出会不利影响个人法律权利或产生约束性义务的完全自動化决定。
  • 协助大规模虚假信息活動。

加速推理

我たち的加速推理方案采用 WavespeedAI 的先進优化技术。这种創新的融合技术显著降低了计算开销和延迟,在不牺牲质量的情况下実現快速図像生成。整个系統経过設计,可以高效处理大规模推理任务,同時确保実時应用在速度与准确性之间达到良好平衡。更多详情请参阅相関連博客文章。

認証

身份验证详情请参阅身份验证指南。


API エンドポイント

提交任务并查询结果

提交任务

curl --location --request POST "https://api.muapi.ai/api/v1/flux-dev-image" \
--header "Content-Type: application/json" \
--header "x-api-key: ${MUAPIAPP_API_KEY}" \
--data-raw '{
    "prompt": "A stylish model, fashion show, showcase a designer outfit, orange colour suit, conspicuous jewelry, fashion show background, vibrant color, dramatic makeup",
    "image": "",
    "size": "1024*1024",
    "num_inference_steps": 28,
    "seed": -1,
    "guidance_scale": 3.5,
    "num_images": 1
}'

获取结果

curl --location --request GET "https://api.muapi.ai/api/v1/predictions/${requestId}/result" \
--header "x-api-key: ${MUAPIAPP_API_KEY}"

任务提交参数

参数必須默認值范围説明
promptstringA stylish model, fashion show, showcase a designer outfit, orange colour suit, conspicuous jewelry, fashion show background, vibrant color, dramatic makeup-用于生成図像的提示词。
imagestring--用于生成図像的输入図像。
mask_imagestring--mask 図像告诉モデル哪些位置需要生成新像素(白色),哪些位置需要保留原図(黑色);它相当于用于定向编辑的模板或引导。
strengthnumber0.80.00 ~ 1.00表示转换参考図像的程度。
sizestring1024*1024每个维度 512 ~ 1536生成図像的尺寸。
num_inference_stepsinteger281 ~ 50执行的推理步数。
seedinteger-1-1 ~ 9999999999对同一版本モデル使用相同 seed 和相同提示词,每次都会输出相同図像。
guidance_scalenumber3.51.0 ~ 20.0CFG(Classifier Free Guidance)比例,用于控制生成図像贴合提示词的程度。
num_imagesinteger11 ~ 4要生成的図像数量。
enable_base64_outputbooleanfalse-启用后,输出会编コードとして BASE64 字符串,而不是 URL。
enable_safety_checkerbooleantrue-設置として true 時启用安全检查器。

パラメータ

任务提交参数

参数必須默認值范围/示例説明
promptstring--用于生成図像的提示词。
imagestring--用于生成図像的输入図像。
mask_imagestring--mask 図像告诉モデル哪些位置需要生成新像素(白色),哪些位置需要保留原図(黑色);它相当于用于定向编辑的模板或引导。
strengthnumber0.80.00 ~ 1.00表示转换参考図像的程度。
sizestring1024*1024每个维度 512 ~ 1536生成図像的尺寸。
num_inference_stepsinteger281 ~ 50执行的推理步数。
seedinteger-1-1 ~ 9999999999对同一版本モデル使用相同 seed 和相同提示词,每次都会输出相同図像。
guidance_scalenumber3.51.0 ~ 20.0CFG(Classifier Free Guidance)比例,用于控制生成図像贴合提示词的程度。
num_imagesinteger11 ~ 4要生成的図像数量。
enable_base64_outputbooleanfalse-启用后,输出会编コードとして BASE64 字符串,而不是 URL。
enable_safety_checkerbooleantrue-設置として true 時启用安全检查器。

响应参数

参数説明
codeintegerHTTP ステータスコード(例如成功時として 200)。
messagestring状态消息(例如“success”)。
data.idstring预测任务的唯一标识符,即任务 ID。
data.modelstring用于预测的モデル ID。
data.outputsarray生成内容的 URL 数组(任务未完成時として空)。
data.urlsobject相関連 API エンドポイント的对象。
data.urls.getstring获取预测结果的 URL。
data.has_nsfw_contentsarray每个输出是否检测到 NSFW 内容的布尔值数组。
data.statusstring任务状态:created、processing、completed 或 failed。
data.created_atstring请求創建時间的 ISO 時间戳(例如“2023-04-01T12:34:56.789Z”)。
data.errorstring错误消息;没有错误時として空。
data.timingsobject時间信息对象。
data.timings.inferenceinteger推理時间(毫秒)。

结果查询参数

参数必須默認值説明
idstring-任务 ID。

结果响应参数

参数説明
codeintegerHTTP ステータスコード(例如成功時として 200)。
messagestring状态消息(例如“success”)。
dataobject包含全部详情的预测数据对象。
data.idstring预测任务的唯一标识符。
data.modelstring用于预测的モデル ID。
data.outputsarray生成内容的 URL 数组(任务未完成時として空)。
data.urlsobject相関連 API エンドポイント的对象。
data.urls.getstring获取预测结果的 URL。
data.has_nsfw_contentsarray每个输出是否检测到 NSFW 内容的布尔值数组。
data.statusstring任务状态:created、processing、completed 或 failed。
data.created_atstring请求創建時间的 ISO 時间戳。
data.errorstring错误消息;没有错误時として空。
data.timingsobject時间信息对象。
data.timings.inferenceinteger推理時间(毫秒)。