Skip to main content
提交图片或视频生成请求。生成异步进行 — 使用状态查询端点轮询完成情况。同一端点同时支持图片模型(GPT Image 2、Nanobanana、Seedream、Midjourney 等)和视频模型(Seedance 2.0、Veo 3.1、Grok Video 等),通过 modelId 选择。

请求

请求头

请求体参数

string
必填
要生成的图片的文本描述。
string
用于生成的模型。不传则使用平台当前默认模型(可能随平台配置变化)。模型列表是模型 ID 的权威来源。 模型会不断上新与下线,请在运行时动态解析 ID,不要在自己这边硬编码一份模型清单。该端点返回的所有模型都可用于本端点,API Token 调用同样不受限。常用取值:图片 gpt-image-2nanobanana-2midjourney-v8.1;视频 seedance-2-0veo-3.1
rhart-1.5(GPT image 1.5)已于 2026-04-22 下线,请改用 gpt-image-2midjourney-v7 已于 2026-05-09 由 midjourney-v8.1 接替(出于向后兼容仍接受老 ID 调用)。
string
默认值:"auto"
生成媒体的宽高比。
  • 默认 auto(推荐):为你自动挑选合适的比例。
  • 也可显式指定——必须是 模型列表 返回的 supported_ratios 之一。常见图片比例:1:1, 3:4, 4:3, 16:9, 9:16, 21:9, 5:4, 4:5
  • Seedance 2.0 还接受特殊值 adaptive,按 referenceImagesreferenceVideo 的尺寸自适应。仅在提供其中之一时才使用 adaptive;无参考时的行为未定义。
  • Seedance 2.0 上不传 aspectRatio(或传了无法识别的取值)都会解析为 adaptive 纯文生视频没有可供自适应的参考,因此在不带参考图/参考视频生成时,请务必显式指定比例。
最终采用的比例会同时在本端点的响应和状态端点的 aspectRatio 字段返回。
string
输出分辨率。可用性取决于模型。不传则使用所选模型的默认分辨率。可选值取决于模型:图片模型用 1K / 2K / 3K / 4K;视频模型用 480p / 720p / 1080p / 4k(视频侧的 k 是小写)。并非每个视频模型都支持全部取值 —— 4k 仅 Seedance 2.0 的 pro 档和 Veo 3.1 支持,Seedance 上的 1080p 同样需要 pro 档。各模型实际支持的分辨率和默认值详见模型对比
string
默认值:"low"
仅用于 GPT Image 2.0。可选 low / medium / high。其他模型会忽略该参数。
string[]
参考图数组。每一项必须是可公开访问的 HTTP(S) URL,或形如 data:image/png;base64,... 的内联 base64 数据。本地文件路径(如 C:/Users/...)与 file:// URI 会被拒绝,返回 400 / invalid_reference_url最大数量按模型不同——请始终以模型列表返回的 max_reference_images 为准。撰写时的实况:
object
Midjourney V8.1 高级参数。对其他模型无效。(字段名沿用历史命名,向后兼容。)
string
默认值:"content"
仅用于 Midjourney V8.1。参考图片的解读方式。
  • content — 用作主题素材参考
  • style — 仅提取视觉风格
number
视频时长(秒)。不传则按该模型的默认时长出片。调用视频模型时请始终显式传 duration 上表”默认”列只是不传该字段时实际出片的时长,计费并不跟着它走:漏传 duration 时,费用会回落到该模型的名义单价,而不是按出片时长计算,因而可能明显高于显式写清时长的同一请求。Veo 3.1 的落差最大 —— 漏传时按该模型单次计费的最高价扣,显式传 duration: 4 则按 4 秒档计费。无论怎么传,实际扣除的积分都会在响应的 creditsUsed 中返回,请以该字段为准,不要自行推算。
string
支持多档位模型的画质档位。
  • Seedance 2.0:mini(默认)、fastpro
  • Veo 3.1:fast(默认)或 pro
档位越高画质越好,每秒单价也越高。不传则使用该模型自身的默认档 —— 注意 Seedance 2.0 的默认档是最便宜的 mini。完整价格矩阵见模型
string
仅用于 Seedance 2.0。用于”视频续写”模式的参考视频 URL。必须是可公开访问的 HTTPS URL(一般来自之前生成结果的 videoUrl 字段)。传该字段时计费走”有参考视频”档(Mini 480p 7、720p 13;Fast 480p 8、720p 14;Pro 720p 16、1080p 28 积分/秒),并应用最低计费秒数(详见模型)。
number
仅用于 Seedance 2.0 + 参考视频续写。参考视频本身的时长(秒),与 duration 一起用于确定实际计费秒数(详见模型 定价表)。referenceVideo 时必须同时传该字段——漏传会按 0 处理,可能导致计费明显低于预期且续写效果异常。

响应

boolean
请求是否被接受。
string
生成请求的唯一 ID。用此 ID 轮询状态。
string
初始状态,始终为 "processing"
number
本次生成扣除的积分数。
string
本次生成使用的模型。
string
本次生成最终采用的宽高比。默认 auto 会选择合适的比例,提交时即在此返回 —— 无需等第一次轮询,可用于在界面上按正确比例预留占位。
object
扣除后更新的积分余额。

查询生成状态

轮询此端点以检查图片是否就绪。

响应(处理中)

响应(图片已完成)

响应(视频已完成)

  • aspectRatio 是该次生成最终采用的比例(如果你传了 auto,这里是实际落地的值)。
  • mediaType 取值 imagevideo。视频生成时 imageUrl/imageUrlsnull,反之亦然。
  • Midjourney V8.1 每次返回 4 张候选图片,imageUrls 包含全部候选,imageUrl 始终指向第一张。其他图片模型返回单张。

响应(失败)

生成失败时,积分会自动退还。可通过 creditsStatus 确认退款是否落地:pending(已预扣,结果未定)、confirmed(已实际扣费)、refunded(已退回余额)。

示例

基本生成

省略 modelId 即使用默认模型(gpt-image-2):

带参考图片

Midjourney V8.1 风格参考

Seedance 视频生成(文生视频)

计费:这里没有传 tier,因此走 Seedance 的默认 Mini 档 —— 720p 单价 16 积分/秒 × 5 秒 = 80 积分。改传 "tier": "fast"(20 积分/秒 → 100 积分)或 "pro" 会更贵,详见模型

Seedance 视频续写(参考视频)

计费:这里没有传 tier,因此走默认 Mini 档 —— 480p 带参考视频单价 7 积分/秒,计费秒数 = max(3 + 5, 9) = 9 秒,共 63 积分。同样的请求走 fast 档则是 8 × 9 = 72 积分。输出视频长度 = duration = 5 秒。

让系统自动选比例(Auto)

省略 aspectRatio 或显式传 "auto",由 MeiGen 自动挑选合适比例:
实际采用的比例会通过 aspectRatio 字段返回 —— 本次请求的响应和状态端点里都有。