v2.0

Omni 视频生成

基于 Gemini Veo 的视频生成服务,支持文生视频、图生视频(最多 5 张参考图)、视频转视频(V2V,最多 2 个参考视频)。

模型与价格

模型能力计费价格
omni-fast文生视频 / 图生视频按次¥0.36/次
omni-fast-v2v视频转视频(V2V)按次¥0.51/次
omni-fast-no-water文生/图生视频(无水印)按次¥0.46/次
omni-fast-v2v-no-waterV2V(无水印)按次¥0.61/次
无水印模型输出经过自动清洗处理,完成前可能多一个 processing 阶段,稍慢。失败不计费。

接口信息

说明
提交任务POST /v1/videos(JSON 或 multipart)
轮询进度GET /v1/videos/{task_id}
下载成片GET /v1/videos/{task_id}/content 或返回的 data[0].url
鉴权Authorization: Bearer sk-你的令牌
令牌分组gemini-高速

核心参数

参数类型必填默认说明
modelstring-模型名,见上表
promptstring-视频描述提示词
aspect_ratiostring16:9画幅比例:16:9(横)、9:16(竖)
seconds / durationstring/int10时长秒数(接收但当前 Gemini 固定输出约 10 秒)
image_urlstring-单张参考图(公网 URL 或 data:image Base64)
first_image_urlstring-首帧参考图 URL
last_image_urlstring-末帧参考图 URL
video / video_urlstring-V2V 源视频 URL(≤8MB、≤1920x1080)。传 2 个视频时可用这两个字段各放一个
videosstring[]-V2V 多源视频数组(最多 2 个,每个 ≤8MB)
imagesstring[]-多参考图数组(最多 5 张,每张 ≤8MB)

Multipart 提交(支持文件上传)

字段说明
input_reference参考图文件上传(最多 5 张,每张 ≤8MB)
input_video / input_video2V2V 源视频文件上传(每个 ≤8MB,最多 2 个)。传 2 个视频用 input_video+input_video2,或两个文件都用同一字段名(如都叫 video)各传一个

示例:文生视频

curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "omni-fast",
    "prompt": "雨夜霓虹街道,镜头缓慢推进,电影感光影",
    "aspect_ratio": "16:9"
  }'

示例:图生视频

curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "omni-fast",
    "prompt": "保持人物一致,缓慢走动",
    "image_url": "https://your-cdn.com/photo.jpg",
    "aspect_ratio": "16:9"
  }'

示例:视频转视频(V2V)

# Multipart 文件上传
curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" \
  -F "model=omni-fast-v2v" \
  -F "prompt=将画面风格转换为赛博朋克风" \
  -F "input_video=@source.mp4"

示例:双视频 V2V(2 个参考视频)

curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "omni-fast-v2v",
    "prompt": "融合两段素材,保持连续运动",
    "videos": ["https://your-cdn.com/a.mp4", "https://your-cdn.com/b.mp4"],
    "aspect_ratio": "16:9"
  }'

也可用 multipart/form-data 上传两个视频文件(字段 input_video + input_video2):

# 双视频 · multipart 文件上传
curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" \
  -F "model=omni-fast-v2v" \
  -F "prompt=第一个视频的人和第二个视频的人一起跳舞" \
  -F "input_video=@person1.mp4" \
  -F "input_video2=@person2.mp4"

轮询取片

curl https://YOUR_BASE/v1/videos/{task_id} \
  -H "Authorization: Bearer sk-xxx"

# 完成后:
# {"status":"completed","data":[{"url":"/v1/videos/{task_id}/content"}]}

Python 完整示例

import time, requests

BASE = "https://YOUR_BASE/v1"
H = {"Authorization": "Bearer sk-xxx", "Content-Type": "application/json"}

# 提交
task = requests.post(f"{BASE}/videos", headers=H, json={
    "model": "omni-fast",
    "prompt": "雨夜霓虹街道,镜头缓慢推进",
    "aspect_ratio": "16:9"
}).json()
task_id = task["task_id"]

# 轮询
while True:
    time.sleep(8)
    s = requests.get(f"{BASE}/videos/{task_id}", headers=H).json()
    if s["status"] == "completed":
        print("下载:", s["data"][0]["url"])
        break
    if s["status"] == "failed":
        print("失败:", s.get("error"))
        break
    print(f"进度: {s.get('progress', 0)}%")

注意事项

🎬 如何提高视频成功率

omni 视频偶发失败(被拒 / 误出图 / 超时重试)多与调用方式有关。高成功率用户普遍遵循以下几点,可显著降低失败率:

一句话:带参考图 + 讲清每张图是谁 / 什么场景 + 内容合规,成功率能明显提升。

Flow · Veo 3.1 视频

当前对外提供两个视频别名:flow-veo-3-1(标准)与 flow-veo-3-1-fast(Fast)。两者均为异步任务,固定按次计费;失败任务不计费。

视频走 OpenAI 兼容接口 /v1/videos(提交→轮询→下载)。请求中的视频参数会透传;只有下文标注“已验证”的组合才属于当前接入承诺。

接口信息

说明
视频 提交POST /v1/videos(当前公开契约:JSON)
视频 轮询GET /v1/videos/{task_id}status=completed 后取顶层 video_url(兼容 data[0].url
视频 下载优先下载完成任务返回的 video_url;媒体已就绪后也可使用 /v1/videos/{task_id}/content
鉴权Authorization: Bearer sk-你的令牌
计费按次(不随 seconds、分辨率或图片数量变化)
耗时通常需要等待数十秒至数分钟;客户端应轮询,不要重复提交同一任务

当前公开模型与价格

模型能力价格
flow-veo-3-1Veo 3.1 标准视频生成;文生、单图首帧、首尾帧字段可用¥0.46 / 次
flow-veo-3-1-fastVeo 3.1 Fast;请求结构与标准版相同,优先低延迟¥0.40 / 次

价格是固定任务价,不是按秒价。即使传入 seconds,本组仍只扣一次对应模型的价格。

请求参数(当前接入范围)

字段类型必填说明
modelstring只使用 flow-veo-3-1flow-veo-3-1-fast
promptstring画面、主体、动作、镜头和音频意图;建议写清主体数量与运动方向
secondsstring / number推荐使用字符串,例如 "4"。当前最低已验证请求为 4 秒;实际成片可能被服务归一化为默认时长,请以完成任务的媒体信息为准
durationnumber / stringseconds 的兼容写法,例如 4;不要同时传两个不同值
resolutionstring当前已验证 720p;更高档位未在本组公开承诺中,传入后仍应检查实际输出
sizestring兼容画布字段,例如 720x12801280x720;与 aspect_ratio 同时传时以实际返回媒体为准
aspect_ratiostring可传 16:99:16 作为画幅意图;当前已实测字段可提交,但服务可能归一化输出画幅
image_urlstring单张图生视频主图;支持公网 HTTPS 图片 URL 或 data:image/...;base64,...
input_reference / image_referencestring / file当前两个 Flow 别名不公开支持;实测会返回 HTTP 403。单图请使用 image_url
first_image_urlstring首帧图片 URL 或 data URI;可单独使用,等同单图生视频
last_image_urlstring尾帧图片 URL 或 data URI;必须与 first_image_url 成对使用,形成首尾帧过渡
imagesstring[]多图参考图数组;最多 3 张。每个元素是公网 HTTPS 图片 URL 或 data:image/...;base64,...
图片数量边界(已实测):单图首帧为 1 张;首尾帧为固定 2 张;多图参考使用 images,最多 3 张。传入第 4 张会在任务执行阶段返回 INVALID_ARGUMENT。首尾帧请求不要再混入 images

示例 1:文生视频(最低已验证参数)

BASE_URL="https://newapi-2.oairegbox.cc"
TOKEN="sk-你的Flow令牌"

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "flow-veo-3-1",
    "prompt": "一只橘猫在窗边抬头,阳光缓慢移动,固定机位,电影感",
    "seconds": "4",
    "resolution": "720p",
    "aspect_ratio": "16:9"
  }'

Fast 版只需把 model 改为 flow-veo-3-1-fast。提交成功会返回 task_id

示例 2:单图生视频(I2V / 首帧)

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "flow-veo-3-1-fast",
    "prompt": "保持人物外观和服装一致,让人物自然回头并向镜头走来",
    "seconds": "4",
    "resolution": "720p",
    "image_url": "https://cdn.example.com/start.jpg"
  }'

也可以把 image_url 的值换成 data:image/jpeg;base64,...。图片必须能被服务端读取,不能使用需要登录的网页地址。

示例 3:首尾帧过渡(固定两张图)

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "flow-veo-3-1",
    "prompt": "镜头从室内平滑移动到阳台,人物动作和光线自然衔接",
    "seconds": "4",
    "resolution": "720p",
    "first_image_url": "https://cdn.example.com/first.jpg",
    "last_image_url": "https://cdn.example.com/last.jpg"
  }'

首尾帧也支持 base64。first_image_urllast_image_url 必须成对;不要同时再传 images 或其他参考图数组。

示例 4:多图参考(最多 3 张)

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "flow-veo-3-1-fast",
    "prompt": "把图 1 的人物置于图 2 的场景,参考图 3 的光线风格,镜头缓慢推进",
    "seconds": "4",
    "resolution": "720p",
    "images": [
      "https://cdn.example.com/character.jpg",
      "https://cdn.example.com/scene.jpg",
      "https://cdn.example.com/style.jpg"
    ]
  }'

images 最多 3 张,数组顺序就是参考图顺序。需要免图床时,把每一个 URL 换成各自的 data:image/jpeg;base64,... 即可。

图片上传格式

当前公开契约是 JSON + URL / data URI。本地图片先转成 data URI,再放入 image_urlfirst_image_urllast_image_urlimages 数组:

IMAGE_B64=$(base64 < ./start.jpg | tr -d '\n')
curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -H "Content-Type: application/json" \
  -d "{
    \"model\": \"flow-veo-3-1-fast\",
    \"prompt\": \"让图片中的主体自然运动\",
    \"seconds\": \"4\",
    \"resolution\": \"720p\",
    \"image_url\": \"data:image/jpeg;base64,$IMAGE_B64\"
  }"
input_referenceimage_reference 和 multipart 文件字段目前实测返回 HTTP 403,不属于这两个公开别名的可用上传方式。请使用 JSON 中的 URL 或 data URI。

轮询、取 URL 与下载

TASK_ID="task_xxx"

# 单次查询
curl -sS "$BASE_URL/v1/videos/$TASK_ID" \
  -H "Authorization: Bearer $TOKEN" | jq .

# shell 轮询示例(每 5 秒一次)
while :; do
  BODY=$(curl -fsS "$BASE_URL/v1/videos/$TASK_ID" \
    -H "Authorization: Bearer $TOKEN") || exit 1
  STATUS=$(printf '%s' "$BODY" | jq -r '.status // "unknown"')
  echo "status=$STATUS"
  case "$STATUS" in
    completed|success|succeeded) break ;;
    failed|error) printf '%s\n' "$BODY" | jq .; exit 1 ;;
  esac
  sleep 5
done

VIDEO_URL=$(printf '%s' "$BODY" | jq -r '.video_url // .data[0].url // empty')
test -n "$VIDEO_URL" || { echo "completed but no video_url" >&2; exit 1; }
curl -fL "$VIDEO_URL" -o flow-veo-result.mp4

完成任务通常会返回顶层 video_url;客户端应同时兼容 data[0].url。返回的下载地址是临时地址,请及时转存,不要把地址写死到业务配置。

返回与错误处理

// 提交
{ "task_id": "task_xxx", "status": "queued", "progress": 0 }

// 轮询完成
{ "task_id": "task_xxx", "status": "completed", "progress": 100,
  "video_url": "https://sd.oaibox.xyz/d/dl/video/20260813/example.mp4" }

// 失败
{ "task_id": "task_xxx", "status": "failed",
  "error": { "code": "...", "message": "..." } }

接入建议与限制

Gemini 高速文本模型

高速分组的文本模型使用独立 -fast 名称,与 Official 分组的官方标准模型名和价格完全隔离。

模型

模型说明计费
gemini-3.1-flash-lite-fast轻量高速文本 / 多模态按 token
gemini-3.5-flash-fast高速文本 / 多模态按 token

接口

说明
请求POST /v1/chat/completions
令牌分组gemini-高速
价格不同客户分组倍率可能不同,以账号模型广场为准
curl https://newapi-2.oairegbox.cc/v1/chat/completions \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.5-flash-fast",
    "messages": [{"role":"user","content":"你好"}]
  }'
高速令牌请使用上表带 -fast 后缀的模型名称。

反重力 Antigravity(Claude + Gemini 图文)

基于 Google Antigravity 免费额度的独立分组,提供 Claude(Opus / Sonnet 4.6)+ Gemini 文本 + 原生 4K 出图。标准 OpenAI 兼容接口,支持 function call。令牌分组 gemini-anti

模型与价格

模型类型价格(¥ 与 $ 按 1:1)
claude-opus-4-6-thinkingClaude 顶配·带思考入 $3.2/M · 出 $16/M · 缓存 $0.32
claude-sonnet-4-6Claude 均衡入 $2.4/M · 出 $12/M · 缓存 $0.24
gemini-3.1-pro-lowGemini Pro 文本入 $0.48/M · 出 $2.88/M
gemini-3-flashGemini Flash 文本入 $0.4/M · 出 $1.6/M
gemini-3.6-flash-highGemini Flash 高质入 $0.24/M · 出 $2/M · 缓存 $0.06
gemini-3.1-flash-image-4k原生 4K 出图(5632×3072)按次 ¥0.112/张
以上为 gemini-anti 分组卖价(已含分组倍率)。实际以模型广场为准。

接口信息

说明
请求POST /v1/chat/completions
Base URLhttps://newapi.oairegbox.cc
令牌分组gemini-anti
Function Call支持(tools / tool_choice
流式支持("stream": true

示例:Claude 对话

curl https://newapi.oairegbox.cc/v1/chat/completions \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-sonnet-4-6",
    "messages": [{"role":"user","content":"用一句话解释量子纠缠"}]
  }'

示例:4K 出图

图像通过对话接口返回,结果在 choices[0].message.images[].image_url.urldata:image/jpeg;base64)。强制输出 4K(5632×3072)。

curl https://newapi.oairegbox.cc/v1/chat/completions \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.1-flash-image-4k",
    "messages": [{"role":"user","content":"一只戴宇航头盔的柴犬,电影级布光"}]
  }'

示例:Function Call

curl https://newapi.oairegbox.cc/v1/chat/completions \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-sonnet-4-6",
    "messages": [{"role":"user","content":"北京天气如何"}],
    "tools": [{"type":"function","function":{
      "name":"get_weather",
      "parameters":{"type":"object","properties":{"city":{"type":"string"}}}
    }}]
  }'

Python(OpenAI SDK)

from openai import OpenAI

client = OpenAI(api_key="sk-xxx", base_url="https://newapi.oairegbox.cc/v1")
resp = client.chat.completions.create(
    model="claude-sonnet-4-6",
    messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)

注意事项

官方 Key(Google AI Studio 原生模型)

直连 Google AI Studio 的官方标准模型,模型名与官方完全一致。令牌分组 gemini-official。文本 / 图像走 /v1/chat/completions;音乐为异步按次任务。价格 = 官方价 × 分组倍率。

文本模型(按 token)

模型价格
gemini-2.5-pro入 $2/M · 出 $16/M
gemini-2.5-flash入 $0.48/M · 出 $4/M
gemini-3.1-pro-preview入 $3.2/M · 出 $19.2/M · 缓存 $0.32
gemini-3.1-pro-preview-customtools入 $3.2/M · 出 $19.2/M
gemini-pro-latest入 $3.2/M · 出 $19.2/M
gemini-3.5-flash入 $2.4/M · 出 $14.4/M
gemini-flash-latest入 $2.4/M · 出 $12/M
gemini-3-flash-preview入 $0.8/M · 出 $4.8/M · 缓存 $0.08
gemini-3.1-flash-lite / gemini-3.1-flash-lite-preview入 $0.4/M · 出 $2.4/M
gemini-flash-lite-latest入 $0.48/M · 出 $4/M
gemini-robotics-er-1.6-preview入 $1.6/M · 出 $8/M

图像模型

模型计费价格
gemini-3-pro-image / -preview按 token入 $3.2/M · 出 $192/M
gemini-3.1-flash-image按 token入 $0.8/M · 出 $96/M
gemini-3.1-flash-image-preview按 token入 $0.4/M · 出 $96/M
gemini-3.1-flash-lite-image按 token入 $0.4/M · 出 $48/M
gemini-2.5-flash-image按 token入 $0.48/M · 出 $48/M
gemini-3-pro-image-preview-1k按次¥0.214/张
gemini-3-pro-image-2k按次¥0.214/张
gemini-3-pro-image-4k按次¥0.384/张
按 token 的图像模型,生成图像本身计入输出 token(故输出单价看似高)。

音乐(异步按次)

模型类型价格
lyria-3-pro-preview音乐按次 ¥0.128/次
lyria-3-clip-preview音乐·短按次 ¥0.064/次

接口信息

说明
文本 / 图像POST /v1/chat/completions
音乐异步任务 POST /v1/videos 提交 → 轮询取片(同「Omni 视频生成」板块)
Base URLhttps://newapi.oairegbox.cc
令牌分组gemini-official

示例:官方文本

curl https://newapi.oairegbox.cc/v1/chat/completions \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-2.5-pro",
    "messages": [{"role":"user","content":"你好"}]
  }'

示例:官方出图

curl https://newapi.oairegbox.cc/v1/chat/completions \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3-pro-image",
    "messages": [{"role":"user","content":"赛博朋克风格的城市夜景"}]
  }'

示例:官方音乐(lyria,异步任务)

curl -X POST https://newapi.oairegbox.cc/v1/videos \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "lyria-3-pro-preview",
    "prompt": "轻快的钢琴爵士,适合咖啡馆"
  }'
# 轮询取片同上(GET /v1/videos/{task_id})

注意事项

Veo-Clean 去水印

上传带水印的视频,系统自动去除水印后返回。异步任务流程与视频生成一致。

模型与价格

模型计费价格
veo-clean按秒¥0.02/秒
按视频实际时长计费。例如 10 秒视频 = ¥0.20。失败不计费。

参数

参数类型必填说明
modelstring固定 veo-clean
promptstring可省略,默认 "remove watermark"
input_videofile带水印视频文件(≤20MB,必须 multipart 上传)

示例

# Multipart 上传
curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" \
  -F "model=veo-clean" \
  -F "prompt=remove watermark" \
  -F "input_video=@watermarked.mp4"

# 轮询取片(同其他视频模型)
curl https://YOUR_BASE/v1/videos/{task_id} \
  -H "Authorization: Bearer sk-xxx"

注意事项

Adobe Firefly · Veo 3.1

Adobe Firefly 视频生成现已提供 Veo 3.1 标准版、Veo 3.1 Fast(静音档,无音频)与 Veo 3.1 Fast Direct(含音频)。两者均使用 OpenAI 兼容的异步视频接口:提交任务后轮询,完成时从响应中的 video_url 获取成片。

本页仅列出当前已验收并已开放的 VEO 模型。Sora 2 尚未开放;请勿以模型名或参数猜测方式调用未列出的模型。

模型

模型说明当前验收规格
firefly-veo-3.1Veo 3.1 标准版 · 含音频文/图生视频,4 秒、6 秒、8 秒
firefly-veo-3.1-fastVeo 3.1 Fast,优先低延迟 · 无音频(静音输出)文/图生视频,4 秒、6 秒、8 秒
firefly-veo-3.1-fast-directVeo 3.1 Fast 高质档 · 含音频(同为 Fast,仅积分档可用)文/图生视频,4 秒、6 秒、8 秒
⚠️ 音频说明(重要)firefly-veo-3.1-fast无音频的静音档,成片不含任何音频轨如需带音频,请改用 firefly-veo-3.1-fast-direct(同为 Fast、含音频)或 firefly-veo-3.1 标准版(含音频)。

实际计费、模型可见性和可用额度以控制台模型列表及你的 API 令牌权限为准。

接口信息

说明
Base URLhttps://newapi-2.oairegbox.cc
提交任务POST /v1/videos
查询任务GET /v1/videos/{task_id}
鉴权Authorization: Bearer sk-你的令牌
任务模式异步;提交成功仅表示任务已入队
成片交付任务 statuscompleted 后,读取顶层 video_url

参数

参数类型必填说明
modelstring使用上表中的一个模型名
promptstring视频画面、主体、动作、镜头和风格描述
secondsstring目标时长(秒),可选 "4""6""8",三者均支持
video_secondsstring无需传;只传 seconds 即可
sizestring两种传法,任选其一:
像素式 宽x高"1280x720"(横 720p)、"720x1280"(竖 720p)、"1920x1080"(横 1080p)、"1080x1920"(竖 1080p)——画幅与清晰度自动识别,video_resolution 无需传。
官网式 纵横比 "16:9"(横)/ "9:16"(竖)——此时必须同时传 video_resolution,否则报错。
video_resolutionstring条件必填size像素时:无需传(清晰度由像素决定)。size纵横比16:9/9:16)时:必填,取 "720p""1080p",否则报“size 为纵横比(16:9/9:16)时必须同时提供 video_resolution”。
input_referencestring / 文件图生视频用:参考图(首帧)。可传图片 URL、base64(data:image/...;base64,)或 multipart 文件(@frame.jpg);不传即为文生视频。带此参数时整个请求改用 multipart 表单提交(见下方“图生视频”示例)
size 支持两种传法:① 像素尺寸(如 1280x720),画幅与清晰度自动识别,无需 video_resolution;② 官网式纵横比(16:9/9:16)+ 必填 video_resolution720p/1080p),对齐 Adobe 官网“画幅 + 分辨率”两栏。两套输出完全一致。音频区分:firefly-veo-3.1(标准版)与 firefly-veo-3.1-fast-direct 默认含音频;而 firefly-veo-3.1-fast 为静音档、无音频轨

size 取值与输出

size(传这个)画幅清晰度
"1280x720"横版 16:9720p
"720x1280"竖版 9:16720p
"1920x1080"横版 16:91080p
"1080x1920"竖版 9:161080p

官网式取值(size 纵横比 + video_resolution

sizevideo_resolution输出
"16:9""720p"横版 1280x720
"16:9""1080p"横版 1920x1080
"9:16""720p"竖版 720x1280
"9:16""1080p"竖版 1080x1920

示例:提交 6 秒 Fast 视频

BASE_URL="https://newapi-2.oairegbox.cc"
TOKEN="sk-xxx"

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "firefly-veo-3.1-fast",
    "prompt": "日出时一盏彩色纸灯笼缓缓飘过安静的湖面,水面泛起微光,电影感镜头,无文字无标志。",
    "seconds": "6",
    "size": "1280x720"
  }'

示例:官网式参数(纵横比 + 分辨率)

与像素式输出完全一致,区别只是把画幅和清晰度拆成 size(纵横比)+ video_resolution 两栏,对齐 Adobe 官网 UI。size 传纵横比时 video_resolution 必填

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "firefly-veo-3.1-fast",
    "prompt": "日出时一盏彩色纸灯笼缓缓飘过安静的湖面,水面泛起微光,电影感镜头,无文字无标志。",
    "seconds": "6",
    "size": "16:9",
    "video_resolution": "720p"
  }'

示例:图生视频(带参考图 input_reference)

在文生的基础上,用 multipart 表单额外带一张参考图作为首帧,其余参数(secondssize)一致。input_reference 支持本地文件图片 URLbase64 三种传法。

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -F 'model=firefly-veo-3.1' \
  -F 'prompt=让画面里的主体自然动起来,镜头缓慢向前推进,保持构图。' \
  -F 'seconds=6' \
  -F 'size=1280x720' \
  -F 'input_reference=@frame.jpg;type=image/jpeg'
图片 URL:把最后一行换成 -F 'input_reference=https://your-cdn.com/frame.jpg';用 base64:换成 -F 'input_reference=data:image/jpeg;base64,<...>'。提交后与文生一样轮询 GET /v1/videos/{task_id},完成后取顶层 video_url

首尾帧(First / Last Frame)

first_frame(起始帧)和 last_frame(结束帧)两张图,引导 Veo 从首帧画面过渡到尾帧画面。两个字段都支持图片 URLbase64data:image/...;base64,)或 multipart 文件只传 first_frame 等同于用首帧做图生视频(与上面的 input_reference 首帧一致)。首尾帧模式与下方“多参考图”模式互斥,不能同一请求混用(Adobe 官方规则,混传会在生成前返回 400、不计费)。

参数类型说明
first_framefile / url / base64起始帧图片(可单独使用=首帧图生视频)。别名:first_image_url
last_framefile / url / base64结束帧图片(与 first_frame 一起=首尾过渡)。别名:last_image_url
⚠️ Veo 的首尾帧按两张参考图处理(首帧、尾帧各作为一个参考引导),过渡的具体表现由模型把控、未必是逐帧线性插值,实际以成片为准。参考图请用真实、合规的照片(勿用随机占位图 / 纯色图;含可识别真人面孔可能触发内容策略)。
curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "firefly-veo-3.1",
    "prompt": "镜头从清晨薄雾笼罩的湖面缓缓推进,雾气逐渐散去,远处倒影渐渐清晰",
    "seconds": "8",
    "size": "16:9",
    "video_resolution": "720p",
    "first_frame": "https://your-cdn.com/first.jpg",
    "last_frame":  "https://your-cdn.com/last.jpg"
  }'
首尾帧也可走 multipart 文件:改成 -F 'model=firefly-veo-3.1' -F 'first_frame=@first.jpg;type=image/jpeg' -F 'last_frame=@last.jpg;type=image/jpeg'prompt/seconds/size 同样用 -F 传)。

多参考图(Reference Images)

reference_images 传入多张参考图,引导角色、风格与构图。Veo 取用前若干张作参考(标准版 firefly-veo-3.1 最多 3 张、Fast 版最多 2 张),支持图片 URL、base64 或 multipart(重复字段名传多张)。与首尾帧模式互斥:同一请求不能同时传 first_frame/last_frame,混传在生成前返回 400、不计费。

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -F 'model=firefly-veo-3.1' \
  -F 'prompt=保持这几张参考图的人物形象与画面风格,让主体自然动起来' \
  -F 'seconds=6' \
  -F 'size=1280x720' \
  -F 'reference_images=@char.jpg;type=image/jpeg' \
  -F 'reference_images=@style.jpg;type=image/jpeg'
参考图须为真实合规照片;超量或与首尾帧字段混用会在生成前返回 400(不扣积分)。

成功提交会返回异步任务,例如:

{
  "id": "task_xxx",
  "status": "queued",
  "model": "firefly-veo-3.1-fast",
  "progress": 0
}

示例:轮询并获取成片

curl -sS "$BASE_URL/v1/videos/task_xxx" \
  -H "Authorization: Bearer $TOKEN"

当响应中的 statuscompleted 时,读取 video_url

{
  "id": "task_xxx",
  "status": "completed",
  "model": "firefly-veo-3.1-fast",
  "video_url": "https://..."
}
video_url 是短期签名下载地址,请在有效期内下载或转存。当前请直接使用完成任务返回的 video_url,不要依赖 /v1/videos/{task_id}/content

常见问题

Adobe Firefly · Seedance 2.0

Adobe Firefly 的 Seedance 2.0 与 Seedance 2.0 Fast 视频模型。支持文生视频单图生视频,使用 OpenAI 兼容的异步视频接口:提交任务后轮询,完成时读取 video_url 获取成片。四档均原生自带音频(对白 / 音效 / 环境音同步生成),无需额外参数。

本页仅适用于 firefly 分组的 Adobe Firefly Seedance 模型;与导航中另一套 Seedance 服务是独立通道、独立模型和独立素材协议,不能混用模型名或多图参数。

模型与价格

模型版本固定输出分辨率价格
firefly-Seedance-2.0-fast-480pSeedance 2.0 Fast480p¥0.10/秒
firefly-Seedance-2.0-fast-720pSeedance 2.0 Fast720p¥0.25/秒
firefly-Seedance-2.0-480pSeedance 2.0 标准版480p¥0.15/秒
firefly-Seedance-2.0-720pSeedance 2.0 标准版720p¥0.35/秒
视频默认带音频(AAC 音轨):Seedance 2.0 是 Adobe 官方原生音频模型,一次生成即同步产出对白 / 音效 / 环境音;四档(标准 / Fast × 480p / 720p)全部自带音频,无需额外参数、也不额外计费

模型名已固定输出分辨率;video_resolution 只能填写与所选模型一致的值,不能用 480p SKU 请求 720p 输出。

已支持规格

参数可用值说明
seconds / duration4 ~ 15(任意整数)输出时长(秒);Adobe 官方支持 4–15 秒
video_resolution480p720p必须与模型名的固定 SKU 相同
size16:9 / 9:16,或下列精确像素横竖画幅;也可使用 aspect_ratio
输出档位16:9 横版9:16 竖版
480p854x480480x854
720p1280x720720x1280

单图生视频(I2V)

提交一张首帧参考图即可启用图生视频;不带图片则为文生视频。input_reference 为单张首帧图。若需首尾帧或多图 / 视频 / 音频参考,见下方“首尾帧”“全能参考(Omni)”两节。可上传 JPEG/JPG、PNG、WebP。服务会按目标画幅进行居中裁切、缩放并转为 PNG 后提交;建议先按目标画幅准备主体清晰的图片,以免裁掉重要内容。

字段类型必填说明
modelstring上表之一
promptstring描述运动、镜头和画面变化
secondsinteger/string4 ~ 15 任意整数;默认 4
video_resolutionstring480p 或 720p,必须匹配模型
sizestring16:9 / 9:16,或精确输出像素
input_referencefile图生时是单张首帧图;使用 multipart/form-data 上传
image_stylestring可选风格化:真人参考 → 漫剧角色时传 anime(详见下方“参考图含真人脸 · image_style”一节);留空 = 原图直发,想保留真人请勿传

示例:文生视频

BASE_URL="https://newapi-2.oairegbox.cc"
TOKEN="sk-xxx"

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "firefly-Seedance-2.0-fast-480p",
    "prompt": "一盏纸灯笼在夜色湖面上缓缓漂过,水面反射暖色灯光,电影感镜头。",
    "seconds": 5,
    "video_resolution": "480p",
    "size": "854x480"
  }'

示例:单图生视频

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -F 'model=firefly-Seedance-2.0-fast-480p' \
  -F 'prompt=让画面中的山间云雾缓慢流动,镜头轻微向前推进。' \
  -F 'seconds=5' \
  -F 'video_resolution=480p' \
  -F 'size=854x480' \
  -F 'input_reference=@frame.jpg;type=image/jpeg'

参考图含真人脸 · image_style 风格化(可选)

先分清你要哪种结果,再决定用不用这个参数:

一句话:真人要真人 → 用三视图多图参考,别传 image_style;真人要漫剧脸 → 传 image_style=anime不传该参数时行为完全不变(原图直发),主动权在你。
参数可用值说明
image_styleanime仅对带参考图的图生视频(i2v)生效:提交 Adobe 前把参考图转成动漫 / 绘画风,用于把真人参考做成漫剧角色。留空 = 不处理(原图直发)。目前支持 anime 一种,后续按需增加。
curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -F 'model=firefly-Seedance-2.0-fast-480p' \
  -F 'prompt=参考图中的人物,转成漫剧角色在城市街头行走,日系动漫画风' \
  -F 'seconds=5' \
  -F 'video_resolution=480p' \
  -F 'size=854x480' \
  -F 'input_reference=@person.jpg;type=image/jpeg' \
  -F 'image_style=anime'
参考图门过了之后,Adobe 输出侧的内容 / 版权审核仍是概率性的,个别任务可能要重试 1–2 次才出片;失败不计费。想保留真人、不要漫剧脸时,用上面“三视图多图参考”的做法,别传 image_style

首尾帧(First / Last Frame)

提供起始帧结束帧图片,Seedance 生成从首帧平滑过渡到尾帧的视频。用 first_framelast_frame 两个字段,支持 multipart 文件、图片 URL 或 base64(data:image/...;base64,)。只传 first_frame 即为单首帧动画。首尾帧模式与下方“全能参考”模式互斥,不能同一请求混用(Adobe 官方规则)。

参数类型说明
first_framefile / url / base64起始帧图片(可单独使用)
last_framefile / url / base64结束帧图片(与 first_frame 一起=首尾过渡)
curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -F 'model=firefly-Seedance-2.0-fast-480p' \
  -F 'prompt=镜头从第一张画面平滑过渡到第二张画面,电影感运镜' \
  -F 'seconds=5' \
  -F 'size=854x480' \
  -F 'first_frame=@first.jpg;type=image/jpeg' \
  -F 'last_frame=@last.jpg;type=image/jpeg'

全能参考(Omni · 图 / 视频 / 音频)

Seedance 2.0 的核心能力:一次最多提供 9 张图 + 3 段视频 + 3 段音频(总计 ≤ 9 个参考资产)作为风格、角色、构图、运镜、音效的引导。用 reference_imagesreference_videosreference_audios 传入,可在 prompt 里用文字说明各参考的作用。参考视频引导运动与氛围(不是直接动画化)。与首尾帧模式互斥。

参数数量上限单文件上限说明
reference_images9100 MiB参考图(风格 / 角色 / 构图)
reference_videos350 MiB参考视频(运镜 / 氛围,建议 2–15s)
reference_audios350 MiB参考音频(节奏 / 音效)
三类合计 ≤ 9 个;多值用重复字段名传(如 -F 'reference_images=@a.jpg' -F 'reference_images=@b.jpg')。超量、超大、或与首尾帧字段混用会返回 400(生成前拦截,不扣积分)。
curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -F 'model=firefly-Seedance-2.0-fast-480p' \
  -F 'prompt=参考图片的色调、视频的运镜、音频的节奏,生成一段电影感镜头' \
  -F 'seconds=5' \
  -F 'size=854x480' \
  -F 'reference_images=@style.jpg;type=image/jpeg' \
  -F 'reference_videos=@motion.mp4;type=video/mp4' \
  -F 'reference_audios=@beat.mp3;type=audio/mpeg'

更多参考用法示例

① 仅多图参考(角色/风格一致性,最多 9 张,重复字段名传多张):

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -F 'model=firefly-Seedance-2.0-fast-480p' \
  -F 'prompt=保持这几张参考图的人物形象与画面风格,让主体自然走动' \
  -F 'seconds=6' \
  -F 'size=854x480' \
  -F 'reference_images=@char1.jpg;type=image/jpeg' \
  -F 'reference_images=@char2.jpg;type=image/jpeg' \
  -F 'reference_images=@style.jpg;type=image/jpeg'

② 图 + 参考视频(用视频引导运镜/氛围,不直接动画化):

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -F 'model=firefly-Seedance-2.0-fast-720p' \
  -F 'prompt=参考图片的主体,沿用参考视频的镜头运动方式生成' \
  -F 'seconds=5' \
  -F 'size=1280x720' \
  -F 'reference_images=@subject.jpg;type=image/jpeg' \
  -F 'reference_videos=@camera-move.mp4;type=video/mp4'

③ 图 + 参考音频(用音频引导节奏/情绪):

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -F 'model=firefly-Seedance-2.0-fast-480p' \
  -F 'prompt=参考图片的场景,随音乐的舒缓节奏缓慢运镜' \
  -F 'seconds=8' \
  -F 'size=854x480' \
  -F 'reference_images=@scene.jpg;type=image/jpeg' \
  -F 'reference_audios=@music.mp3;type=audio/mpeg'

④ 仅首帧动画(只给起始帧,让静图动起来):

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -F 'model=firefly-Seedance-2.0-fast-480p' \
  -F 'prompt=让画面中的云雾缓慢流动,镜头轻微向前推进' \
  -F 'seconds=5' \
  -F 'size=854x480' \
  -F 'first_frame=@start.jpg;type=image/jpeg'

⑤ 标准版 720p + 图片 URL(JSON)——参考图支持公网 URL / base64;视频、音频仅支持 multipart 文件或 base64(不接受 URL):

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "firefly-Seedance-2.0-720p",
    "prompt": "参考这张图的色调,生成一段唯美空镜",
    "seconds": 8,
    "size": "1280x720",
    "reference_images": ["https://example.com/ref1.jpg", "https://example.com/ref2.jpg"]
  }'

轮询结果

curl -sS "$BASE_URL/v1/videos/task_xxx" \
  -H "Authorization: Bearer $TOKEN"

任务状态依次为 queuedin_progresscompletedfailed。当状态为 completed 时,读取响应中的 video_url;建议每 5-10 秒轮询一次,不要为同一请求并发重复提交。

Adobe Firefly · Kling 3.0

Adobe Firefly 的 Kling 3.0 与 Kling 3.0 Omni 视频模型。支持文生视频图生视频(首帧参考图)Omni 多主体参考(@元素,单次最多 3 个),使用 OpenAI 兼容的异步视频接口:提交任务后轮询,完成时读取顶层 video_url 获取成片。

模型名区分大小写Kling 首字母大写、Omni 首字母大写),请严格按下表填写,否则会报 model_not_found

模型与价格 · 按秒计费

模型版本清晰度价格时长
firefly-Kling-3.0-720pKling 3.0 标准720p¥0.045/秒5–15 秒(自定义)
firefly-Kling-3.0-1080pKling 3.0 标准1080p¥0.065/秒5–15 秒(自定义)
firefly-Kling-3.0-Omni-720pKling 3.0 Omni(全能参考)720p¥0.08/秒5–15 秒(自定义)
firefly-Kling-3.0-Omni-1080pKling 3.0 Omni(全能参考)1080p¥0.10/秒5–15 秒(自定义)
按秒计费 = 单价 × 时长。例如 Kling 3.0 720p 10 秒 = ¥0.45。失败不计费
视频默认带音频(AAC 音轨):Kling 3.0 标准与 Omni 均自带生成音效,无需额外参数。

接口信息

说明
Base URLhttps://newapi-2.oairegbox.cc
提交任务POST /v1/videos
查询任务GET /v1/videos/{task_id}
鉴权Authorization: Bearer sk-你的令牌
任务模式异步;提交成功仅表示任务已入队,需轮询
成片交付任务 statuscompleted 后,读取顶层 video_url

参数(参考 Adobe 官方)

参数类型必填说明
modelstring上表 4 个模型之一(区分大小写)
promptstring画面、主体、动作、镜头与风格描述
seconds / durationstring"5" ~ "15" 任意整数;Adobe 官方支持自定义时长,最多 15 秒(标准与 Omni 同)
sizestring输出像素尺寸 宽x高;画幅(横/竖)与清晰度(720p/1080p)由像素自动识别(见下表)
input_referencestring / 文件图生视频用:首帧参考图,支持图片 URL、base64 或 multipart 文件;带此参数时整个请求改用 multipart 表单
@元素名(写在 prompt 里)prompt 内引用Omni 多主体参考用:先用 POST /v1/entities 把参考图创建成命名“元素”,再在 prompt 中用 @元素名 引用。单个请求最多 3 个元素(第 4 个起被上游拒:reference_elements: at most 3 items)。详见下方“多主体参考”示例。仅 firefly-Kling-3.0-Omni-* 支持
size(传这个)画幅清晰度
"1280x720"横版 16:9720p
"720x1280"竖版 9:16720p
"720x720"方形 1:1720p
"1920x1080"横版 16:91080p
"1080x1920"竖版 9:161080p
"1080x1080"方形 1:11080p
Adobe 官方 Kling 支持三种画幅:16:9(横)/ 1:1(方)/ 9:16(竖);也可用 aspect_ratio16:9 / 1:1 / 9:16

示例:文生视频

BASE_URL="https://newapi-2.oairegbox.cc"
TOKEN="sk-xxx"

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "firefly-Kling-3.0-720p",
    "prompt": "一只雄鹰在金色夕阳下掠过雪山之巅,电影感镜头,缓慢推进。",
    "seconds": "5",
    "size": "1280x720"
  }'

示例:图生视频(首帧参考图 input_reference)

multipart 表单带一张参考图作为首帧,其余参数一致。input_reference 支持本地文件、图片 URL 或 base64。

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -F 'model=firefly-Kling-3.0-720p' \
  -F 'prompt=让画面中的主体自然动起来,镜头缓慢向前推进,保持构图。' \
  -F 'seconds=5' \
  -F 'size=1280x720' \
  -F 'input_reference=@frame.jpg;type=image/jpeg'
图片 URL:把最后一行换成 -F 'input_reference=https://your-cdn.com/frame.jpg';用 base64:换成 -F 'input_reference=data:image/jpeg;base64,<...>'

示例:Omni 多主体参考(@元素,最多 3 个)

Kling 3.0 Omni 支持把参考图作为命名“元素”(主体/角色/物体/场景),在 prompt 中用 @元素名 引用,让生成画面保持该主体的一致性。单个视频请求最多引用 3 个元素(第 4 个起会被上游拒绝:reference_elements: List should have at most 3 items)。分两步:

第 1 步:创建元素(POST /v1/entities

每个元素用 1~4 张参考图构建(建议 4 张不同角度,效果更稳)。typecharacter(角色)/ object(物体)/ location(场景)。

curl -sS -X POST "$BASE_URL/v1/entities" \
  -H "Authorization: Bearer $TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "name": "Alice",
    "type": "character",
    "images": [
      "https://your-cdn.com/alice_front.jpg",
      "https://your-cdn.com/alice_side.jpg"
    ]
  }'
图片可传图片 URLbase64data:image/...;base64,);每个元素 1~4 张。可重复调用创建多个元素(如 AliceBobCafe)。用 GET /v1/entities 查看已建元素,DELETE /v1/entities/{id} 删除。

第 2 步:生成时用 @元素名 引用(最多 3 个)

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "firefly-Kling-3.0-Omni-720p",
    "prompt": "@Alice 和 @Bob 在 @Cafe 里相视而笑,暖色灯光,电影感镜头。",
    "seconds": "5",
    "size": "1280x720"
  }'
上限:单次最多 3 个 @元素(本网关经 Adobe Firefly,硬上限为 3;超过报 reference_elements: at most 3 items)。被引用的元素须已通过第 1 步创建;同一请求引用的多个元素需属于同一账号(网关自动路由,无需手动指定)。此功能仅 firefly-Kling-3.0-Omni-720p / firefly-Kling-3.0-Omni-1080p 支持。

示例:轮询并获取成片

curl -sS "$BASE_URL/v1/videos/task_xxx" \
  -H "Authorization: Bearer $TOKEN"

当响应中的 statuscompleted 时,读取顶层 video_url(短期签名下载地址,请在有效期内下载或转存)。

常见问题

Adobe Firefly · Gemini Omni Flash

Google Gemini Omni Flash 视频模型,经 Adobe Firefly 接入。同一个模型名支持三种模式,按你传入的素材自动切换:只传 prompt = 文生视频(T2V);额外带一张参考图 = 图生视频(I2V);额外带一段参考视频 = 视频生视频(V2V)。OpenAI 兼容异步接口:提交任务后轮询,完成时从响应顶层 video_url 获取成片。

成片无音频(静音输出)。三种模式的规格、时长档、计费完全一致。

模型与价格

模型模式时长清晰度计费价格
firefly-gemini-omni-720p文生 / 图生 / 视频生视频(自动)4 / 6 / 8 / 10 秒720p按秒¥0.20 / 秒
按秒计费,三种模式同价:4 秒 ¥0.80、6 秒 ¥1.20、8 秒 ¥1.60、10 秒 ¥2.00。实际计费、模型可见性与可用额度以控制台模型列表及你的 API 令牌权限为准。

接口信息

说明
Base URLhttps://newapi-2.oairegbox.cc
提交任务POST /v1/videos
查询任务GET /v1/videos/{task_id}
鉴权Authorization: Bearer sk-你的令牌
任务模式异步;提交成功仅表示任务已入队
成片交付任务 statuscompleted 后,读取顶层 video_url

参数

参数类型必填说明
modelstring固定 firefly-gemini-omni-720p
promptstring视频画面、主体、动作、镜头和风格描述
secondsstring目标时长(秒),仅支持 "4""6""8""10"
sizestring画幅,取 "1280x720"(横 720p)或 "720x1280"(竖 720p);也接受纵横比 "16:9" / "9:16"。仅 720p,无需传 video_resolution
video_resolutionstring"720p";传纵横比 size 时可选传,不传也默认 720p
input_referencestring / 文件图生视频(I2V)用:参考图(首帧)。可传图片 URL、base64(data:image/...;base64,)或 multipart 文件(@frame.jpg)。带此参数时整个请求改用 multipart 表单提交(见下方示例)。首发支持单张参考图
input_video文件 / base64视频生视频(V2V)用:参考视频。仅支持 multipart 文件(@clip.mp4)或 base64(data:video/mp4;base64,);不支持纯 http URL。带此参数时整个请求改用 multipart 表单提交(见下方示例)
模式互斥优先级:同时传图和视频时按 视频生视频 处理。input_reference(图)与 input_video(视频)都是可选,都不传即为文生视频。

size 取值与输出

size画幅清晰度
"1280x720""16:9"横版 16:9720p
"720x1280""9:16"竖版 9:16720p

示例一:文生视频(T2V,JSON)

BASE_URL="https://newapi-2.oairegbox.cc"
TOKEN="sk-xxx"

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "firefly-gemini-omni-720p",
    "prompt": "日出时一只金毛小狗在草地上奔跑,柔和晨光,电影感镜头。",
    "seconds": "4",
    "size": "1280x720"
  }'

示例二:图生视频(I2V,带参考图 input_reference)

在文生的基础上,用 multipart 表单额外带一张参考图作为首帧,其余参数(secondssize)一致。input_reference 支持本地文件图片 URLbase64 三种传法。

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -F 'model=firefly-gemini-omni-720p' \
  -F 'prompt=让画面里的小狗自然转头看向镜头并摇尾巴,镜头缓慢推进。' \
  -F 'seconds=4' \
  -F 'size=1280x720' \
  -F 'input_reference=@frame.jpg;type=image/jpeg'
图片 URL:把最后一行换成 -F 'input_reference=https://your-cdn.com/frame.jpg';用 base64:换成 -F 'input_reference=data:image/jpeg;base64,<...>'

示例三:视频生视频(V2V,带参考视频 input_video)

multipart 表单带一段参考视频,模型在其基础上按 prompt 重新演绎(改风格、加动作等)。input_video 仅支持本地文件(@clip.mp4)或 base64,不支持纯 http URL。

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -F 'model=firefly-gemini-omni-720p' \
  -F 'prompt=把这段片子改成水彩画风格,保留原有的运动。' \
  -F 'seconds=4' \
  -F 'size=1280x720' \
  -F 'input_video=@clip.mp4;type=video/mp4'
base64:把最后一行换成 -F 'input_video=data:video/mp4;base64,<...>'

示例四:轮询并获取成片

三种模式提交后都返回异步任务,轮询方式一致:

curl -sS "$BASE_URL/v1/videos/task_xxx" \
  -H "Authorization: Bearer $TOKEN"

当响应中的 statuscompleted 时,读取顶层 video_url

{
  "id": "task_xxx",
  "status": "completed",
  "model": "firefly-gemini-omni-720p",
  "video_url": "https://..."
}
video_url 是短期签名下载地址,请在有效期内下载或转存。当前请直接使用完成任务返回的 video_url,不要依赖 /v1/videos/{task_id}/content

注意事项

Adobe Firefly · GPT Image 2

Adobe Firefly 的 GPT Image 2 文生图模型,三档质量(Low / Medium / High)。使用 OpenAI 兼容的异步接口:提交任务后轮询,完成时读取 video_url 获取图片(PNG)。

本页为 firefly 分组的 Adobe Firefly GPT Image 2,与导航中 gpt-fast 分组的 GPT-Image-2 是独立通道、独立上游,模型名不同、不能混用。

模型与价格

模型质量档价格
firefly-gpt-image-1kLow¥0.04/张
firefly-gpt-image-2kMedium¥0.06/张
firefly-gpt-image-4kHigh¥0.06/张
三档像素名副其实:1k 最长边 ~1024px、2k ~2048px、4k 顶到 3840px。近方形画幅的 4k 受 Adobe 8.29M 总像素硬限——1:1 最高只到 2880×2880、5:4/4:3/3:2 约 3200-3500,只有宽幅(16:9 / 9:16 / 21:9)能满 3840。auto 档不承诺具体像素(Adobe 自选)。

三档实际输出像素

画幅1k2k4k
1:11024×10242048×20482880×2880
16:91088×6082048×11363840×2128
9:16608×10881136×20482128×3840
21:91248×5282048×8643840×1616
5:41024×8162048×16483200×2576
4:31024×7522048×15203328×2480
3:21024×6722048×13603504×2352

画幅

通过 aspect_ratio(或 size)选画幅,支持:auto1:116:99:165:44:33:24:53:42:321:9。不传默认 1:1

参数

字段类型必填说明
modelstring上表之一
promptstring图片描述
aspect_ratiostring画幅,见上;默认 1:1

示例

# 提交任务
curl https://newapi-2.oairegbox.cc/v1/videos \
  -H "Authorization: Bearer $TOKEN" -H "Content-Type: application/json" \
  -d '{"model":"firefly-gpt-image-2k","prompt":"a cozy reading nook by a rainy window, warm lamp light","aspect_ratio":"9:16"}'
# 返回 {"id":"task_xxx","status":"queued"}

# 轮询结果
curl https://newapi-2.oairegbox.cc/v1/videos/task_xxx \
  -H "Authorization: Bearer $TOKEN"
# 完成时 {"status":"completed","video_url":"https://.../xxx.png"}

图生图(i2i · 支持多图参考)

在文生图基础上加 images1–6 张参考图(图片 URL 数组),模型会把每张参考图作为主体(subject)融合进结果。价格与文生图同档,参考图张数不额外收费。

参考图最多 6 张(超出返回 400)。多图必须用数组字段 images(或 reference_images);仅单张时也可用 input_reference(字符串)。真人脸参考图会被 Adobe 审核拒绝(确定性失败),请用合规图片。
# 图生图(images 数组,1–6 张);轮询同文生图
curl https://newapi-2.oairegbox.cc/v1/videos \
  -H "Authorization: Bearer $TOKEN" -H "Content-Type: application/json" \
  -d '{"model":"firefly-gpt-image-1k","prompt":"blend the reference subjects into one scene","images":["https://example.com/a.jpg","https://example.com/b.jpg"]}'

Adobe Firefly · 错误码 & 审核问题归档

Adobe Firefly 的内容审核较严格,视频任务失败大多来自 Adobe 侧的内容审核输入不合规,而非网关故障。收到失败后请先看错误类型判断能否重试:内容审核 / 参数类属确定性失败(同样输入重试必然再失败,需改输入);账号 / 过载类属可自动恢复(网关会自动换号或重试,通常自愈)。失败不计费。

⚠️ Adobe 审核严(重点)真人脸参考图、涉敏/名人/品牌等提示词、生成结果被判不安全、生成音频疑似版权 都会被 Adobe 拒绝。这类是确定性拒绝——同一张图 / 同一句提示词重试永远失败,必须更换输入,请勿对同一失败任务反复重试

一、内容审核类(Adobe 拒绝 · 重试无效 · 需改输入)

错误触发返回提示(示例)处理
参考图含真人脸
reference_image_privacy_error
参考图 / 首帧里出现真实人物面孔参考图中包含真人面孔,Adobe 内容策略拒绝生成…换成不含真人脸的参考图;确需用真人图时,加可选参数 image_style=anime(见下)让网关先把参考图风格化(动漫化)再生成
提示词不安全
prompt_unsafe
提示词含 Adobe 判定的不适宜内容(暴力 / 成人 / 名人 / 品牌等)提示词被 Adobe 内容安全策略判定为不适宜…改写提示词,去掉敏感 / 名人 / 品牌 / 违规描述
生成结果不安全
video_unsafe
成片被 Adobe 事后审核判定不安全(提交时未拦、生成后拒绝)请求被 Adobe 内容策略拒绝(video_unsafe)…调整提示词或更换随机种子后重试
音频疑似版权
native audio copyright
带音频的模型(如 Seedance)生成的音频被 Adobe 判可能涉版权Adobe 判定本次生成的音频可能涉及版权限制…调整提示词或更换参考素材后重试(尽量避免具体歌曲 / 台词 / 品牌音效等易触发版权的描述)

参考图含真人脸的解法 · image_style 风格化(可选)

参考图真人脸是最常见的审核拒绝之一。确需用真人照片做图生视频(i2v)时,可加一个可选参数 image_style:网关会在提交 Adobe 前把你的参考图整图风格化(转成明显非真实照片的画风),从而通过 Adobe 的“真人脸”内容审核。不传 image_style 时行为完全不变(原图直发)——是否风格化的主动权在你。

参数取值说明
image_styleanime把参考图转成动漫 / 绘画风后再生成;仅对带参考图的图生视频(i2v)生效,适用于 Seedance / VEO / Kling / Gemini-Omni。留空 = 不处理。目前支持 anime 一种,后续按需增加。

作为顶层字段传(与 prompt / model / seconds 同级)。示例(multipart):

curl https://newapi-2.oairegbox.cc/v1/videos \
  -H "Authorization: Bearer $TOKEN" \
  -F model=Seedance-2.0-fast-480p -F seconds=4 -F "size=9:16" \
  -F prompt="镜头缓缓推近,人物自然微笑" \
  -F input_reference=@person.jpg \
  -F image_style=anime
⚠️ 用前须知:① 输出会是动漫 / 绘画风(不再是写实真人),请按需使用;② 风格化能过“真人脸参考门”,但 Adobe 的输出侧审核video_unsafe / 音频版权)仍是概率性的,个别任务可能要重试 1-2 次才出片(失败不计费);③ 这是把真人变风格化的绕行方案,不适用需要保留写实真人的场景。

二、输入 / 参数不合规(确定性失败 · 需改请求)

错误触发处理
参考图无法识别
cannot identify image file
传入的参考图不是有效图片(文件损坏 / 非图片 / base64 截断错误)确认图片能正常打开;base64 用完整 data:image/...;base64, 前缀
参考图 URL 不合规
Only http/https or data URL images are supported / fetch image_url … 404
参考图 URL 非 http(s) / data,或该 URL 404 取不到用可公开访问的 http(s) 直链,或改用 base64 / 文件上传
参考图数量超限
validation_error … at most N items
该模型不支持多参考图或超过上限按对应模型文档的参考图上限提交
提示词过长
prompt: at most 2500 characters
prompt 超过 2500 字符精简提示词到 2500 字符内
画幅 / 时长参数冲突size(横)与 aspect_ratio(竖)互相矛盾;或时长档位不支持见各模型页参数说明;时长只认 secondssize 传纵横比时必带 video_resolution

三、账号 / 权限 / 配额(多为可自动恢复)

错误含义处理
模型访问被拒
Adobe model access denied
当前账号无该模型权限无音频权限(如普通档请求带音频的模型)。网关会自动换号重试多数自动恢复;持续失败说明该模型 / 该内容需积分档账号或特定权限,请联系我们
积分不足 / 耗尽
taste_exhausted / credit balance below cost
该账号积分不足以支撑本次生成,网关自动改用其它账号一般自动恢复;整体积分紧张时联系我们补充
限流
rate_limit / 429
账号短时请求过密稍后重试并降低并发

四、临时 / 基础设施(网关自动重试 · 通常自愈)

错误含义处理
上游过载
408 system under load
Adobe 上游瞬时过载网关自动重试;持续可稍后再试
上游内部错误
Unknown internal error
Adobe 生成侧瞬时内部错误网关自动重试;重试后仍失败再联系我们
超时
timeout / 参考图下载超时
生成超时,或参考图 URL 下载慢 / 失败重试;参考图尽量用稳定直链或直接上传文件
📌 排查建议:失败时请保留 任务 ID(task_xxx完整错误响应再联系我们——凭任务 ID 可在后台定位到具体那一条。内容审核 / 参数类属确定性失败,请勿对同一任务反复重试(既不会成功,也占用账号请求配额)。

Seedance 2.0 视频生成

⚠️ 部分高级参考功能维护升级中(临时):升级期间 9 图参考暂降为 ≤4 图全能参考「933」暂为 4 图 + ≤3 视频 + 1 音频音频参考暂为 ≤1@人物一致性绑定暂不可用;恢复后本提示自动撤除。其余功能正常:文生视频 / 图生视频(多图 ≤4)/ 参考视频 ≤3 / 参考音频 ×1 / 首尾帧 / 单图图生视频,480p·720p 全档位。

基于 Seedance 2.0 的视频生成服务。各模型调用方式完全一致,切换只需改 model 字段。支持文生视频、图生视频、多参考图(≤9)、参考视频(≤3)、参考音频(≤3)、首尾帧过渡;提供 480p / 720p / 1080p / 4K 多档清晰度。

模型与价格 · 按秒计费

模型版本定位全能参考价格duration 范围
Seedance-2.0-mini-480p480pmini 档,最低价位,走量首选433¥0.20/秒4-15(任意整数)
Seedance-2.0-fast-480p480p经济档,快速出片433¥0.25/秒4-15(任意整数)
Seedance-2.0-480p480p经济档,标准质量,成本最低433¥0.45/秒4-15(任意整数)
Seedance-2.0-mini-720p720pmini 档,高清最低价,走量首选433¥0.35/秒4-15(任意整数)
Seedance-2.0-fast-720p720p高清快速出片,性价比高433¥0.50/秒4-15(任意整数)
Seedance-2.0-720p720p高清标准,质量更佳433¥0.65/秒4-15(任意整数)
Seedance-2.0-1080p1080p超清标准,最高画质,大屏/商用首选833¥1.50/秒4-15(任意整数)
Seedance-2.0-4k4K4K 超高清,顶级画质,商用大屏首选833¥2.00/秒4-15(任意整数)
Seedance2.0 各档均支持 4-15 秒任意整数时长、全部高级参考功能(@Image/@Video/@Audio 引用)。

按秒计费 = 单价 × duration。例如 Seedance-2.0-720p 8秒 = ¥5.20。失败不计费

Pro 满血系列 · 按次固定 15 秒

Pro 满血系列采用按次计费、固定 15 秒成片,画质更强、自带 AI 生成音轨。调用方式与上表完全一致(同 /v1/videos 接口、同参数、同轮询下载流程),只需把 model 换成下表名称——无需传 duration(时长锁定 15 秒)。

模型版本定位全能参考价格(按次)时长
Seedance-2.0-pro-mini-480p480p Pro满血经济档,走量首选933¥5.00/次固定 15 秒
Seedance-2.0-pro-fast-480p480p Pro满血快速档933¥5.50/次固定 15 秒
Seedance-2.0-pro-480p480p Pro满血标准档,最佳质量933¥6.40/次固定 15 秒
Seedance-2.0-pro-mini-720p720p Pro高清满血经济档,走量首选933¥5.00/次固定 15 秒
Seedance-2.0-pro-fast-720p720p Pro高清满血快速档933¥6.40/次固定 15 秒
Seedance-2.0-pro-720p720p Pro高清满血标准,顶级质量933¥8.50/次固定 15 秒
按次计费:每次提交按上表固定收费,与时长无关(统一固定 15 秒成片);暂不支持首尾帧(first_image / last_image);失败不计费

Seedance2.0 四种生成模式(先看这里选对模式)

无需传“模式”参数——服务端按你传入的素材字段自动判定用哪种模式。关键是按手上的素材,传对字段、传够最少必填。

模式用途最少必传可叠加如何触发(传哪些字段)
1 文生视频纯文字生成prompt只传 prompt,不带素材
2 图生视频图驱动,可多参考图prompt + ≥1 张图多图共 ≤9reference_image_urls(单张/多张统一用它,1~9 张),不带视频image_url 兼容保留
3 全能参考图 + 视频 + 音频 混合参考prompt + ≥1 图(再叠加视频/音频)图≤9、视频≤3、音频≤3(俗称 933)reference_videos / reference_audios,并至少配 1 张图
4 首尾帧开始画面→结束画面过渡prompt + first_image_url + last_image_url成对同时传 first + last
全能参考 933:单次最多 9 张图 + 3 个视频 + 3 个音频混合参考;在 prompt@image1…@image9 / @video1…@video3 / @audio1…@audio3 引用对应素材。音频/视频参考须至少配 1 张主图(仅传音频/视频不传图会失败)。

各模式素材数量:图生视频 1~9 张图;全能参考 1~9 图 + ≤3 视频 + ≤3 音频首尾帧固定 2 张(首帧+尾帧),不接受额外参考图——首尾帧模式下额外传的 reference_image_urls 不会生效,要多图请用图生视频/全能参考。

常见错误(请避开):

❌ 错误用法结果✅ 正确做法
全能参考只传视频、没传图失败(提示需要参考图)至少补 1 张主图到 image_url
想要视频参考却只传了图跑成普通图生视频,没用到视频参考视频放进 reference_videos
加音频却只传音频、没配图失败(音频须搭配图/视频)至少补 1 张主图到 image_url,音频放 reference_audios
首尾帧只传了一张报错(须成对)first_image_urllast_image_url 同时给
multipart 上传多张图只识别到 1 张多图用 JSON 传 URL/base64 数组

Seedance2.0 480p / 720p 档规格

Seedance2.0 错误返回

任务失败时(轮询返回 "status":"failed"),响应里 error 为对象 {"code","message"}message 为完整中文说明),并冗余顶层 error_code

error_code含义 / 处理
400017参数或参考图不合规(模型 / 时长 / 画幅 / 图片尺寸格式)——按提示修正后重试
400018提示词过长(超过 5000 字符上限)——缩短 prompt 后重试
500341参考视频不符合要求(mp4/mov、单条 2-15 秒、24-60fps、≤50MB,多条总 ≤15 秒)——更换视频后重试
GENERATION_FAILED生成失败(图片不适合 / 无明显主体,或内容被策略拦截)——更换图片或调整提示词重试
TIMEOUT生成超时——稍后重试
NO_ACCOUNT服务繁忙,暂无可用通道——稍后重试
PROMPT_BLOCKED提示词含违禁内容,已拒绝生成(不消耗额度)——修改提示词后重试
# 失败响应示例
{
  "task_id": "task_xxx",
  "status": "failed",
  "video_url": null,
  "error": {
    "code": "400017",
    "message": "参考图不符合要求:需 JPEG/PNG/WEBP,长边 ≤4000px、每边 ≥300px,宽高比 0.4–2.5,且不超过 30MB,请更换后重试"
  },
  "error_code": "400017"
}

核心参数

参数类型必填说明
modelstringSeedance2.0:Seedance-2.0-mini-480p / Seedance-2.0-fast-480p / Seedance-2.0-480p / Seedance-2.0-mini-720p / Seedance-2.0-fast-720p / Seedance-2.0-720p / Seedance-2.0-1080p / Seedance-2.0-4k;Seedance2.5:Seedance-2.5-480p / Seedance-2.5-720p
promptstring视频描述提示词;多素材时用 @image1/@video1 引用
aspect_ratiostring16:9(默认)、9:161:121:93:44:3
durationinteger时长秒数。Seedance2.0:4-15;Seedance2.5:4-29(任意整数)
image_urlstring单张主参考图(公网 URL / base64 / multipart)
reference_image_urlsarray多参考图,与 image_url 合计 ≤9(Seedance2.0)。兼容别名:reference_images / extra_images / input_reference;单张可用 reference_image元素可为 url 字符串,或 {"url","name"} 对象(推荐,用于 @人物 绑定,见素材说明)
reference_image_namesarray参考图对应的人物/主体名,reference_image_urls 同序一一对应;用于把 prompt 里的 @名字 绑定到正确的图。不传则维持现状(靠 prompt 自行声明)。防错位建议改用 reference_images:[{url,name}] 对象形式。兼容别名 reference_names
reference_image_rolesarray参考图角色,reference_image_urls 同序一一对应subject=人物主体(锁身份)/ background=背景场景(自动声明「仅作场景,不得生成人脸」,治多图融合「背景被当人 / 多余头 / 重影」)。防错位建议改用 reference_images:[{url,name,role}] 对象形式。兼容别名 reference_roles
reference_videos / reference_videoarray / string参考视频 ≤3(Seedance2.0;mp4/mov,2-15s,24-60fps,≤50MB)。兼容别名:extra_videos
reference_audios / reference_audioarray / string参考音频 ≤3(Seedance2.0;mp3 等,prompt@audio1 引用,须配 ≥1 张主图)。兼容别名:audio_url / extra_audios
first_image_url / last_image_urlstring首尾帧过渡(成对提供,Seedance2.0)

高级参考(@Image / @Video / @Audio)

prompt 中用 @Image1@Video1@Audio1 引用对应素材(参考素材上限:图片 ≤9 / 视频 ≤3 / 音频 ≤3,俗称 933)。Seedance2.0 各档均支持多参考图(≤9)、参考视频(≤3)、参考音频(≤3)与首尾帧(字段同上,见「Seedance2.0 480p/720p 档规格」);参考音频须搭配 ≥1 张主图。

参数说明
extra_images参考图数组,最多 9 张,@Image1...@Image9 引用
extra_videos参考视频数组,最多 3 个,@Video1...@Video3 引用
extra_audios参考音频数组,最多 3 个,@Audio1...@Audio3 引用

示例

# 文生视频
curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "Seedance-2.0-720p",
    "prompt": "雨夜霓虹街道,镜头缓慢推进,电影感光影",
    "aspect_ratio": "16:9",
    "duration": 8
  }'

# 多素材参考(图/视频/音频)
curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "Seedance-2.0-720p",
    "prompt": "以 @Image1 的人物、@Video1 的运镜,配合 @Audio1 的节奏生成广告",
    "image_url": "https://cdn.example.com/main.jpg",
    "extra_images": ["https://cdn.example.com/ref.jpg"],
    "extra_videos": ["https://cdn.example.com/ref.mp4"],
    "extra_audios": ["https://cdn.example.com/ref.mp3"],
    "aspect_ratio": "16:9",
    "duration": 10
  }'

# 480p 经济档(文生 / 图生,带 image_url 即图生视频)
curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "Seedance-2.0-fast-480p",
    "prompt": "夕阳下的海浪缓缓拍打沙滩,电影感",
    "image_url": "https://cdn.example.com/main.jpg",
    "duration": 5
  }'

# 480p 图生视频 · base64 直传(免图床,image_url 填 data URI)
curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" -H "Content-Type: application/json" \
  -d '{"model":"Seedance-2.0-fast-480p","prompt":"让画面动起来","duration":5,
       "image_url":"data:image/png;base64,iVBORw0KGgo..."}'

# 480p 图生视频 · multipart 文件上传(免图床,直接传本地图)
curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" \
  -F "model=Seedance-2.0-fast-480p" \
  -F "prompt=让画面动起来" \
  -F "duration=5" \
  -F "image=@/path/to/photo.jpg"

# 720p 高清(文生,model 换成 720p 即可)
curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" -H "Content-Type: application/json" \
  -d '{"model":"Seedance-2.0-fast-720p","prompt":"雪山日出航拍","duration":5}'

# 多参考图(≤9,prompt 用 @image1/@image2 引用)
curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" -H "Content-Type: application/json" \
  -d '{
    "model":"Seedance-2.0-fast-480p",
    "prompt":"@image1 的人物在 @image2 的场景中行走",
    "image_url":"https://cdn.example.com/person.jpg",
    "reference_image_urls":["https://cdn.example.com/scene.jpg"],
    "duration":5
  }'

# 多角色 · 参考图命名(让 prompt 里的 @人物 对上正确的图)
# 推荐:对象数组,name 跟着自己的图走,排序不会错位
curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" -H "Content-Type: application/json" \
  -d '{
    "model":"Seedance-2.0-720p",
    "prompt":"@志强 与 @清雅 在医院走廊相遇,@张秋月 从远处走来",
    "reference_images":[
      {"url":"https://cdn.example.com/zhiqiang.jpg","name":"志强"},
      {"url":"https://cdn.example.com/qingya.jpg","name":"清雅"},
      {"url":"https://cdn.example.com/qiuyue.jpg","name":"张秋月"}
    ],
    "aspect_ratio":"9:16","duration":10
  }'
# 等价平行数组写法(names 须与 urls 同序一一对应):
#   "reference_image_urls":["...zhiqiang.jpg","...qingya.jpg","...qiuyue.jpg"],
#   "reference_image_names":["志强","清雅","张秋月"]
# 不传名字=维持现状:需绑定请自行在 prompt 里写「图一为志强@志强,图二为清雅@清雅」

# 多图融合 · 标明背景图(避免背景里凭空多出人脸 / 重影 / 多余头)
curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" -H "Content-Type: application/json" \
  -d '{
    "model":"Seedance-2.0-720p",
    "prompt":"@志强 站在空旷的办公室里演讲",
    "reference_images":[
      {"url":"https://cdn.example.com/zhiqiang.jpg","name":"志强","role":"subject"},
      {"url":"https://cdn.example.com/office.jpg","role":"background"}
    ],
    "aspect_ratio":"16:9","duration":8
  }'
# 等价平行数组:reference_image_urls + reference_image_names + reference_image_roles 三者同序对应

# 参考视频(≤3,mp4/mov 2-15s 24-60fps ≤50MB;prompt 用 @video1 引用)
curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" -H "Content-Type: application/json" \
  -d '{
    "model":"Seedance-2.0-fast-480p",
    "prompt":"把 @image1 的人物换进 @video1 的画面",
    "image_url":"https://cdn.example.com/person.jpg",
    "reference_videos":["https://cdn.example.com/ref.mp4"],
    "duration":5
  }'

# 首尾帧过渡(first_image_url → last_image_url)
curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" -H "Content-Type: application/json" \
  -d '{
    "model":"Seedance-2.0-fast-480p",
    "prompt":"平滑电影感过渡",
    "first_image_url":"https://cdn.example.com/start.jpg",
    "last_image_url":"https://cdn.example.com/end.jpg",
    "duration":5
  }'

Seedance 2.5 · 新一代视频生成

全新一代 Seedance 2.5 视频模型,动态表现与质感升级,支持超大规模多模态参考(单次最多 30 张图 + 10 段视频 + 10 段音频)。接口、参数、提交→轮询→下载流程与 Seedance 2.0 完全一致,切换只需改 model 字段。

模型与价格

模型版本定位全能参考上限价格(按秒)duration 范围
Seedance-2.5-480p480p新一代经济档,动态与质感升级30 图 / 10 视频 / 10 音频¥0.25/秒4-29(任意整数)
Seedance-2.5-720p720p新一代高清,质量更佳30 图 / 10 视频 / 10 音频¥0.35/秒4-29(任意整数)
按秒计费 = 单价 × duration。例:Seedance-2.5-720p 5 秒 = 0.35×5 = ¥1.75Seedance-2.5-480p 8 秒 = 0.25×8 = ¥2.00生成失败不计费(自动全额退款)

接口与调用流程

步骤接口说明
① 提交任务POST /v1/videos(JSON)返回 task_idstatus:"queued"
② 轮询进度GET /v1/videos/{task_id}建议每 5-10 秒轮询一次,直到 statusSUCCESS/FAILURE(约 3-4 分钟出片)
③ 下载成片取返回体的 video_url完成后 video_url 为可直接 GET 下载的 mp4 链接
鉴权Authorization: Bearer sk-你的令牌

请求参数(全部)

参数类型必填默认说明
modelstring-Seedance-2.5-480pSeedance-2.5-720p
promptstring文生必填-视频文本描述;有参考素材时用 @image1 / @video1 / @audio1 引用对应素材
durationinteger4成片时长(秒),范围 4-29 任意整数;按秒计费的依据。也接受别名 seconds。不传按 4 秒计
aspect_ratiostring16:9画幅比例:16:9(横)、9:16(竖)、1:1(方)。也接受 size(如 1280x720)自动换算
image_urlstring-单张参考图(图生视频)。公网 http/https URL 或 data:image/...;base64,
reference_image_urlsstring[]-多张参考图,最多 30 张。与 image_url 可叠加
reference_imagesobject[]-命名参考图 [{"url":"...","name":"角色名"}],用于多角色让 @角色名 精确对上图(避免排序错位)
first_image_url / last_image_urlstring-首帧 / 尾帧参考图(首尾帧过渡)
reference_videosstring[]-参考视频,最多 10 段。公网可下载 mp4/mov URL;单条分辨率须 ≤ 1080p(长边 ≤1920、短边 ≤1080,上传 2K/4K 会被拒绝)
reference_audiosstring[]-参考音频,最多 10 段。公网可下载 mp3/wav URL
⚠️ 参考素材必须是公网可直接下载的 URL(或 data:...;base64,)——不要用需登录/防盗链的链接,否则上游抓取失败。音频 / 视频参考建议至少配 1 张主图。

示例

① 文生视频(t2v)——只给文字描述:

curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" -H "Content-Type: application/json" \
  -d '{
    "model": "Seedance-2.5-720p",
    "prompt": "夕阳下的海边,海浪缓缓拍打礁石,电影感宽镜头",
    "duration": 5,
    "aspect_ratio": "16:9"
  }'

② 图生视频(i2v)——给一张主图让它动起来(多图用 reference_image_urls,prompt 用 @image1/@image2 引用):

# 单图
curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" -H "Content-Type: application/json" \
  -d '{
    "model": "Seedance-2.5-480p",
    "prompt": "画面中的人物微笑并缓步向前走",
    "image_url": "https://cdn.example.com/person.jpg",
    "duration": 5,
    "aspect_ratio": "9:16"
  }'

# 多图(≤30,@image1=主图、@image2=场景图)
curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" -H "Content-Type: application/json" \
  -d '{
    "model": "Seedance-2.5-720p",
    "prompt": "@image1 的人物在 @image2 的场景中行走",
    "image_url": "https://cdn.example.com/person.jpg",
    "reference_image_urls": ["https://cdn.example.com/scene.jpg"],
    "duration": 6
  }'

③ 全能参考(图 + 视频 + 音频混合,最多 30 图 / 10 视频 / 10 音频)——用 @image / @video / @audio 在 prompt 里引用,须至少配 1 张主图

curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" -H "Content-Type: application/json" \
  -d '{
    "model": "Seedance-2.5-720p",
    "prompt": "@image1 的人物,动作参考 @video1,配合 @audio1 的节奏起舞,电影级光影",
    "image_url": "https://cdn.example.com/person.jpg",
    "reference_videos": ["https://cdn.example.com/dance.mp4"],
    "reference_audios": ["https://cdn.example.com/music.mp3"],
    "duration": 8,
    "aspect_ratio": "16:9"
  }'

④ 轮询 + 下载

# 提交后拿到 {"task_id":"task_xxx","status":"queued"}
curl https://YOUR_BASE/v1/videos/task_xxx \
  -H "Authorization: Bearer sk-xxx"
# 完成后返回 {"status":"SUCCESS","video_url":"https://.../xxx.mp4?..."}
# 直接 GET video_url 即可下载 mp4
约束速记:时长 4-29 秒任意整数(按秒计费,不传默认 4 秒);参考上限 30 图 / 10 视频 / 10 音频,超出自动截断;参考视频分辨率须 ≤ 1080p(长边不超过 1920、短边不超过 1080——上传 2K / 4K 会被直接拒绝,不产生任务、不计费,请先压到 1080p 及以内);参考内容须中性(换脸 / 真人肖像 1:1 还原、含明显版权或敏感画面可能触发上游内容审核);生成失败自动全额退款。

VEO 3.1 · 官方字段兼容

本页对应 Dallas new-api-2 的 veo官转 分组,使用 Google Veo 风格字段名,但传输仍采用本服务的 OpenAI 兼容异步接口 /v1/videos。现有 firefly 分组不受本页参数规则影响。

模型与价格

模型能力计费价格
veo-3.1Veo 3.1 标准版,文生/图生视频,支持音频权益按秒¥0.08/秒
veo-3.1-fastVeo 3.1 Fast,文生/图生视频,支持音频权益按秒¥0.04/秒

令牌分组:veo官转。模型和计费以该分组权限为准;内部适配别名不会出现在公共模型列表。

接口信息

说明
Base URLhttps://newapi-2.oairegbox.cc
提交任务POST /v1/videos
查询任务GET /v1/videos/{task_id}
鉴权Authorization: Bearer sk-你的令牌
成片任务 status=completed 后读取脱敏 data[0].url;也可使用任务 content 接口

官方字段

字段可用值/格式边界
prompt文本必填
aspectRatio16:9 / 9:16仅这两种画幅
resolution720p / 1080p最高 1080p;4k 返回 400
durationSeconds4 / 6 / 8传 6 或 8 时,为按秒计费需同时传同值 seconds
generateAudioboolean实际有声能力受 Adobe 账号权益影响
image首帧图片对象、URL 或 data URL归一化为现有首帧上传链路
negativePrompt文本官方适配器转发;上游是否采用以实际成片为准
seed整数 0..4294967295越界或非整数返回 400
lastFrame图片必须同时提供首帧;适配器使用 frame order 1/2
referenceImages最多 3 张;style 最多 1 张与首尾帧互斥
personGenerationdont_allow / allow_adult / allow_all其他值返回 400
sampleCount1>1 返回 400;单请求只返回一个视频

示例:官方字段提交

BASE_URL="https://newapi-2.oairegbox.cc"
TOKEN="sk-你的veo官转令牌"

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "veo-3.1",
    "prompt": "一只纸船沿着安静的湖面漂流,电影感镜头,无文字无标志",
    "aspectRatio": "16:9",
    "resolution": "720p",
    "durationSeconds": 4,
    "generateAudio": true,
    "negativePrompt": "text, watermark",
    "seed": 123456,
    "personGeneration": "allow_adult",
    "sampleCount": 1
  }'

首帧、尾帧与参考图

image + lastFrame 用于首尾帧;只传 lastFrame、或同时混用 referenceImages 会在生成前返回 400。referenceImages 用于最多 3 张参考图,style 类型最多 1 张。

curl -sS -X POST "$BASE_URL/v1/videos" \
  -H "Authorization: Bearer $TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "veo-3.1",
    "prompt": "镜头从清晨湖面过渡到日出后的明亮湖面",
    "image": {"imageBytes": "<base64首帧>", "mimeType": "image/png"},
    "lastFrame": {"inlineData": {"data": "<base64尾帧>", "mimeType": "image/png"}},
    "aspectRatio": "16:9",
    "resolution": "720p",
    "durationSeconds": 4,
    "seconds": 4
  }'

明确不支持

上游尚未独立收敛的字段(负向词、seed 可复现性、尾帧、人物策略、参考图的 Adobe 语义)会按实际成片结果更新;适配器已知边界不会被描述成 Google 原生协议支持。

Grok 视频(文 / 图生视频)

基于 xAI Grok Imagine 官方接口的视频生成,OpenAI 兼容异步接口。两个模型:grok-imagine-video(1.0,文生 / 图生视频)与 grok-imagine-video-1.5(1.5 代,图生视频、画面质感更好)。带参考图即图生视频,不带图则为纯文生视频(1.5 建议带图)。支持 480p / 720p / 1080p 输出,grok-imagine-video-1.5 可出 1080p 高清

模型与价格

模型能力计费价格
grok-imagine-video文生视频 / 图生视频按次¥0.35/条(任意时长同价)
grok-imagine-video-1.5图生视频(1.5 代,画面更佳,支持 1080p 高清按次¥0.4/条(任意时长同价)
按次计费:与时长无关,每条固定价;失败不计费,成功出片才扣。

接口

说明
提交POST /v1/videos(JSON)
轮询GET /v1/videos/{task_id}status=completed 时返回 video_url
鉴权Authorization: Bearer sk-xxx
令牌分组必须为 grok 分组

参数

参数取值默认说明
modelgrok-imagine-video / grok-imagine-video-1.5-必填
prompt文本-必填,画面 / 运动描述
image公网 URL 或 base64 Data URI-可选。单张首帧;带图=图生视频;grok-imagine-video 不带图=纯文生视频,grok-imagine-video-1.5 建议带图
reference_imagesURL 数组,最多 7 张-可选,多张参考图(图生视频)。仅 grok-imagine-video-1.5480p / 720p 生效;⚠️ 1080p 不支持多图(见下)。单张请用 image
seconds字符串,1 ~ 156视频时长(秒);按次计费,秒数不影响价
aspect_ratio16:9 / 9:16 / 1:1 / 4:3 / 3:4 / 2:3 / 3:2-可选,画幅比例
resolution480p / 720p / 1080p720p可选,分辨率(仅小写)。1080pgrok-imagine-video-1.5 支持;⚠️ 1080p 仅支持单张首帧 image,不支持多图 reference_images
size720x1280 / 1024x1024-旧字段,已兼容:自动换算为最接近的 aspect_ratio(避免"请求竖屏却出横屏");也支持 portrait / landscape / square 等词

传图方式(图生视频)

i2v 的参考图通过 image 字段传入,支持两种写法:

方式写法说明
公网 URL"image": "https://.../a.jpg"公网可直接 GET 的图片直链(不能是需登录 / 内网 / 拦爬虫的链接)
base64 Data URI"image": "data:image/jpeg;base64,/9j/4AAQ..."须带 data: 前缀

图片格式 JPG / PNG / WebP。

单张首帧 vs 多张参考图

⚠️ 1080p 仅支持单张首帧image 模式):选 1080p不能用多图 reference_images——若同时传了多张,只有第一张作首帧生效。需要多张参考图请用 480p / 720p

字段名兼容:单图推荐 image、多图用 reference_imagesimage_url / image_reference / images / image_urls / input_reference 等写法也已兼容(服务端自动识别为参考图,不会退化成纯文生视频)。

接入示例

# 文生视频(grok-imagine-video,不带图)
curl https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-imagine-video",
    "prompt": "灯塔在日落时分,海浪拍打礁石,电影感镜头",
    "seconds": "6",
    "aspect_ratio": "16:9",
    "resolution": "720p"
  }'
# => {"task_id":"task_xxx","status":"queued",...}

# 图生视频(grok-imagine-video-1.5,带 image)
curl https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-imagine-video-1.5",
    "prompt": "轻微镜头推移,画面自然生动",
    "image": "https://your-public-image.jpg",
    "seconds": "6"
  }'

# 多图参考(grok-imagine-video-1.5,最多 7 张,仅 480p/720p)
curl https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-imagine-video-1.5",
    "prompt": "融合多张参考图的场景,电影感转场",
    "reference_images": ["https://img-a.jpg", "https://img-b.jpg"],
    "seconds": "6",
    "resolution": "720p"
  }'

# 轮询直到 completed,取 video_url
curl https://YOUR_BASE/v1/videos/task_xxx \
  -H "Authorization: Bearer sk-xxx"
# => {"status":"completed","video_url":"https://.../xxx.mp4",...}

注意事项

Grok 图像生成(文生图 / 图生图)

OpenAI 兼容的同步图像接口,使用 grok-imagine-image 模型。支持文生图、单图参考和多图参考;请求成功后直接返回图像结果。

模型与价格

模型能力计费价格
grok-imagine-image文生图 / 图生图 / 多图参考按张¥0.05/张
按张计费:每张图片按模型价格计费;生成失败不扣费。

接口

场景请求说明
文生图POST /v1/images/generations(JSON)只传提示词即可生成
图生图POST /v1/images/edits(JSON / multipart)传入一张或多张参考图
鉴权Authorization: Bearer sk-xxx
令牌分组必须为 grok 分组

参数

参数取值默认说明
modelgrok-imagine-image-必填
prompt文本-必填,描述希望生成或修改的画面
n整数1可选,生成数量;建议一次请求传 1
response_formaturl / b64_jsonurlurl 返回下载地址;b64_json 直接返回 Base64 图像数据
image公网 URL 或 base64 Data URI-图生图可选,单张参考图。base64 必须为完整的 data:image/...;base64,... 格式
imagesURL / Data URI 数组-图生图可选,多张参考图;仅 JSON 请求使用

传图方式(图生图)

方式字段 / 写法说明
单张公网图片"image": "https://.../a.jpg"图片地址必须能从公网直接访问
单张 base64"image": "data:image/png;base64,..."使用完整 Data URI,不要只传裸 Base64
多张 JSON 图片"images": ["https://.../a.jpg", "data:image/png;base64,..."]数组中可混用公网 URL 与 Data URI
multipart 文件上传-F "image[]=@a.png" -F "image[]=@b.jpg"单图也可使用 -F "image=@a.png"

接入示例

# 文生图
curl https://YOUR_BASE/v1/images/generations \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-imagine-image",
    "prompt": "一座漂浮在云海上的未来城市,清晨柔光,电影感",
    "n": 1,
    "response_format": "url"
  }'

# 图生图:JSON 单张公网图片
curl https://YOUR_BASE/v1/images/edits \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-imagine-image",
    "prompt": "保留主体构图,将背景改为雨后的霓虹街道",
    "image": "https://your-public-image.jpg",
    "response_format": "url"
  }'

# 图生图:multipart 多张文件
curl https://YOUR_BASE/v1/images/edits \
  -H "Authorization: Bearer sk-xxx" \
  -F "model=grok-imagine-image" \
  -F "prompt=融合两张参考图的风格,生成商品展示图" \
  -F "image[]=@reference-a.png" \
  -F "image[]=@reference-b.jpg" \
  -F "response_format=url"

返回结果与下载

{
  "created": 1786675686,
  "data": [
    {
      "url": "https://YOUR_BASE/v1/images/proxy/<encrypted-token>"
    }
  ]
}

response_format=url 时,返回的是平台下载代理地址,浏览器或程序可直接访问;地址不暴露上游下载域名和签名参数,默认有效期为 30 天。需要自行保存图片数据时,使用 response_format=b64_json 并读取 data[].b64_json

注意事项

GPT-Image-2

文生图 / 图生图 / Chat 生图,支持三种调用方式。

模型与价格

模型价格
gpt-image-2¥0.025/张
gpt-image-2-4k¥0.2/张(4K 异步)

接口

端点方式说明
/v1/images/generationsJSON文生图
/v1/images/editsmultipart图生图(参考图 + 描述)
/v1/chat/completionsJSONChat 对话生图

参数(文生图)

参数类型必填说明
promptstring图片描述。按字符数计(中英文一视同仁,非字节),建议 ≤ 8000 字符(硬上限约 1 万字符,超出会生成失败)
modelstring默认 gpt-image-2
ninteger生成数量 1-4
sizestring1024x10241536x1024(横)、1024x1536(竖)、autosize 主要控制横 / 竖 / 方比例,实际像素由模型自动分配(约 150 万像素,长边约 1536),不保证精确像素尺寸;需要精确高分辨率请用 gpt-image-2-4k
qualitystringauto / low / medium / high
response_formatstringb64_json(默认)或 url(返回完整图片地址,可直接使用)

示例

# 文生图
curl -X POST https://YOUR_BASE/v1/images/generations \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-image-2",
    "prompt": "一只橘猫趴在窗台上晒太阳,水彩画风格",
    "size": "1024x1024",
    "quality": "high"
  }'

# 图生图
curl -X POST https://YOUR_BASE/v1/images/edits \
  -H "Authorization: Bearer sk-xxx" \
  -F "image=@reference.png" \
  -F "prompt=把背景改成海边日落" \
  -F "model=gpt-image-2"

# 图生图(Python:用 files= 让库自动生成 multipart boundary)
import requests
requests.post("https://YOUR_BASE/v1/images/edits",
    headers={"Authorization": "Bearer sk-xxx"},        # 不要手动设 Content-Type
    data={"model": "gpt-image-2", "prompt": "把背景改成海边日落"},
    files={"image": open("reference.png", "rb")})      # files= 自动带 boundary

# Chat 生图(参考图须用 Base64,不支持公网 URL)
curl -X POST https://YOUR_BASE/v1/chat/completions \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-image-2",
    "messages": [{"role":"user","content":[
      {"type":"text","text":"把这张图改成赛博朋克风格"},
      {"type":"image_url","image_url":{"url":"data:image/jpeg;base64,<BASE64>"}}
    ]}]
  }'

注意事项


gpt-image-2-4k(异步 4K)

4K 超清文生图,异步任务制(提交即返回,不占用长连接)。出图分辨率 2880×2880,计费 ¥0.2/张(按次,成功才扣),典型耗时 1–3 分钟。

调用流程

步骤端点说明
① 提交POST /v1/videos返回 {"id":"task_xxx","status":"queued"}
② 轮询GET /v1/videos/{id}status: queued → in_progress → completed
③ 取图完成后读取响应的 video_url 字段(4K 图片地址,可直接下载)

示例

# ① 提交任务
curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{"model":"gpt-image-2-4k","prompt":"一只橘猫坐在窗台上"}'
# → {"id":"task_xxxx","status":"queued"}

# ② 轮询状态(每 5-10 秒一次)
curl https://YOUR_BASE/v1/videos/task_xxxx \
  -H "Authorization: Bearer sk-xxx"
# → {"status":"completed","video_url":"https://.../xxxx.png"}

# ③ 完成后从 video_url 下载 4K 图片

注意事项

Gemini 图像生成

基于 Gemini 的图像生成服务。

模型与价格

模型价格
gemini-image¥0.11/张
gemini-image-pro¥0.12/张

接口

通过 POST /v1/images/generations 调用,参数与 GPT-Image-2 类似。

curl -X POST https://YOUR_BASE/v1/images/generations \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-image",
    "prompt": "赛博朋克风格的东京夜景",
    "size": "1024x1024"
  }'

参考图(图生图 / 编辑)

附带参考图即可进行图生图 / 编辑。image 字段同时支持字符串与数组两种写法,取值可为公网 URL 或 data:image Base64:

字段类型说明
imagestring 或 string[]单张参考图(字符串)或多张参考图(数组)均可
imagesstring[]多张参考图数组(与 image 等效)
maskstring蒙版图,局部重绘可选
curl -X POST https://YOUR_BASE/v1/images/generations \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-image",
    "prompt": "把这两张图融合成一张海报",
    "image": ["https://cdn.example.com/a.jpg", "https://cdn.example.com/b.jpg"]
  }'
兼容说明:image 传单张用字符串、传多张用数组均可。早期部分客户端把图片写成数组会报 cannot unmarshal array into ... image of type string现已兼容修复,无需改动客户端。参考图最多 5 张、每张 ≤5MB。

GPT-Image-2 多档生图(1K 同步 / 异步 · 2K / 3.5K 异步)

GPT-Image-2 按分辨率分三档:1K 可自由选择同步或异步;同步适合需要立即拿图片的客户端,异步适合连接稳定性优先、不能长时间保持请求的客户端。2K / 3.5K 固定走异步接口(提交拿 task_id → 轮询任务 → 下载结果,不占用长连接)。所有档位均支持文生图,附参考图即图生图,最多 6 张;参考图解码后的文件合计不超过 5 MiB。按张固定计费,失败不计费。

输入限制:1K JSON 请求体最多 8 MiB;参考图可使用公网 HTTPS 直链或完整 data:image/png;base64,...data:image/jpeg;base64,...data:image/webp;base64,...,Base64 解码后的参考图合计最多 5 MiB。超过限制会在提交前返回 400,不会扣费。

模型与价格

模型分辨率调用方式价格(按张)
gpt-image-2-1k~1K(默认 1024×1024)同步 /v1/images/generations¥0.025/张
gpt-image-2-1k-async~1K(默认 1024×1024)异步 /v1/videos¥0.025/张
gpt-image-2-2k~2K(默认 2048×2048)异步 /v1/videos¥0.04/张
gpt-image-2-3.5k~3.5K(默认 2880×2880)异步 /v1/videos¥0.06/张
怎么选:需要一次请求直接拿图,用 gpt-image-2-1k 同步;需要提交后自行轮询、规避长连接超时,用 gpt-image-2-1k-async。两者分辨率、参考图能力、积分消耗和价格完全一致。2K/3.5K 始终走异步。用你的生图分组令牌调用即可。

通道 A · 1K 同步(OpenAI 兼容)

参数类型必填说明
modelstringgpt-image-2-1k
promptstring图片描述。按字符数计(中英文一视同仁,非字节),建议 ≤ 8000 字符(硬上限约 1 万字符,超出会生成失败)
sizestring画幅,如 1024x1024 / 1536x1024;不传默认 1:1。仅决定画幅
reference_image_urlsarray参考图(图生图 / 多图融合),最多 6 张,解码后总和 ≤5 MiB;元素可为公网 HTTPS URL 或 data URL。单张也可用 image / image_url
response_formatstring当前返回图片 URL;暂不承诺 b64_json 输出
# 1K 同步:直接返回图片 URL
curl -X POST https://YOUR_BASE/v1/images/generations \
  -H "Authorization: Bearer sk-xxx" -H "Content-Type: application/json" \
  -d '{
    "model":"gpt-image-2-1k",
    "prompt":"a small red apple on a white table, product photo",
    "size":"1024x1024"
  }'
# 返回: {"created":..., "data":[{"url":"https://.../xxx.jpg"}]}
# 当前同步接口返回 URL,不返回 b64_json;需要 Base64 请由客户端下载 URL 后自行编码。

通道 B · 1K / 2K / 3.5K 异步(同视频任务接口)

参数类型必填说明
modelstringgpt-image-2-1k-async / gpt-image-2-2k / gpt-image-2-3.5k
promptstring图片描述。按字符数计(中英文一视同仁,非字节),建议 ≤ 8000 字符(硬上限约 1 万字符,超出会生成失败)
aspect_ratiostring1:1(默认)/ 16:9 / 9:16 / 4:3 / 3:2 / 5:4 及竖版
image_urlstring单张参考图(公网 HTTPS URL 或完整 data:image/...;base64,);填了即图生图
reference_image_urlsarray多图参考(融合),最多 6 张,解码后总和 ≤5 MiB(别名 reference_images / images);JSON、multipart 均可传
# 1) 提交(异步)
curl -X POST https://YOUR_BASE/v1/videos \
  -H "Authorization: Bearer sk-xxx" -H "Content-Type: application/json" \
  -d '{
    "model":"gpt-image-2-1k-async",
    "prompt":"a small red apple on a white table, product photo",
    "aspect_ratio":"1:1"
  }'
# 返回 task_id

# 2) 轮询:只以 status=completed 判定完成,progress 仅供展示
curl https://YOUR_BASE/v1/videos/task_xxx \
  -H "Authorization: Bearer sk-xxx"
# 完成后响应中的 video_url 为图片 URL;也可 GET /v1/videos/task_xxx/content 下载结果。

输入格式与错误处理

Gemini 音乐生成

通过 Chat Completions 接口生成音乐。同步返回(约 30–60 秒),结果是一个可直接下载的音频链接(MP4/M4A,无需鉴权即可 GET 下载)。

模型与价格

模型价格令牌分组
gemini-music¥0.50/首gemini-高速
令牌分组必须为 gemini-高速(或 gemini-低速),否则返回"无可用渠道"。失败不计费。

请求示例

curl https://YOUR_BASE/v1/chat/completions \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-music",
    "messages": [{"role":"user","content":"创作一首轻快的电子风格BGM,适合科技产品广告"}]
  }'

返回示例

下载链接在 choices[0].message.content 里(Markdown 链接 + 纯 URL 各一份):

{
  "choices": [{
    "message": {
      "role": "assistant",
      "content": "✅ 音乐生成完成\n\n[⬇️ 点击下载音乐](https://download.oaibox.xyz/v1/audio/aud-xxxx/content)\n\nhttps://download.oaibox.xyz/v1/audio/aud-xxxx/content"
    },
    "finish_reason": "stop"
  }]
}

从 content 中取出形如 .../v1/audio/aud-xxxx/content 的 URL,直接 GET 即可下载音频(无需带 Authorization)。也支持 "stream": true,链接会在流式结束的那条消息里返回。

下载域名随所用平台不同:平台 A → download.oaibox.xyz,平台 B → download-2.oaibox.xyz。链接为生成后即时缓存,建议尽快下载保存。

通用说明 & FAQ

平台信息

平台Base URL
平台 Ahttps://newapi.oairegbox.cc/v1
平台 Bhttps://newapi-2.oairegbox.cc/v1
两平台能力一致,账号与令牌独立、不互通。选择其一使用即可。

鉴权

所有请求需携带 Authorization: Bearer sk-你的令牌 请求头。令牌在对应平台后台创建,分组必须与模型匹配(错误分组会返回"无可用渠道")。

错误码

HTTP含义处理计费
200成功正常取用成功才扣
400参数/素材问题按 message 改正不计费
401鉴权失败检查令牌不计费
404路径错误检查 URL(勿重复 /v1)不计费
429限速/额度不足降并发或充值不计费
502/5xx服务端临时故障直接重试不计费

FAQ

Q: 视频生成需要多久?

Omni 视频约 1-5 分钟,Grok 视频约 30s-3 分钟(时长越长越慢)。建议客户端超时 ≥300 秒。

Q: 失败会扣费吗?

不会。所有模型失败一律不扣费,仅成功出片/出图才计费。

Q: 参考图被内容策略拒绝怎么办?

包含可识别真人面孔的参考图可能触发 Gemini 内容策略。系统会自动尝试处理并重试。如仍失败,建议:使用非写实风格、虚构人物、侧面/背影/远景,或使用已授权的素材。

Q: 两个平台有什么区别?

能力完全一致。账号和余额独立。选其一使用,不可跨平台混用令牌。

视频生成 · 内容审查避坑指南

适用于 omni-fast / veo 系列视频模型 · 帮你避开 Google 内容审查,提高一次出片成功率

📊 近期实际拒绝统计(系统自动更新 · 2026-08-14 03:07)
按本平台真实拒绝自动统计(已脱敏,不含任何原始提示词):真人/版权/不安全内容 7701 次、参考图被拦截 5472 次、内容审核拒绝 698 次、违禁/侵权 589 次。
绝大多数为真人写实 / 版权·IP / 参考图含敏感元素——请重点对照下方雷区①⑤与「安全改写对照表」。

一、先看这条报错

如果你收到:

This request didn't pass content review (e.g. an identifiable real person, unsafe content, or protected IP). Retrying or switching accounts won't help. Try a non-photorealistic style, a non-identifiable or fictional subject (back/side/distant view), or rights-cleared content, then resubmit.

中文意思:请求没通过内容审查(可能涉及:可识别真人 / 不安全内容 / 受保护版权)。

⚠️ 这是 Google 的「确定性拒绝」
❌ 重试没用 ❌ 换账号没用 ✅ 只能改提示词或换参考图
别反复提交同一个请求,立刻按下面的方法改。

二、六大高危雷区(命中必拒)

① 可识别的真人 / 名人 最常踩
"appears to show specific people" / "展示特定人物"
  • 写实真人正脸、特写人像
  • 任何名人、明星、政治人物、网红的名字或长相
  • 上传真人照片当参考图(尤其正脸特写)
  • 🔑 photorealistic(超写实)+ 真人 = 高危组合
② 未成年人 零容忍
"minors in dangerous or compromising situations"
  • 画面出现儿童 / 婴儿 / 青少年 / 学生
  • 哪怕本意无害,未成年人 + 任何危险或暧昧情境都会被拒
③ 性 / 裸露 / 暧昧 高危
"sexual situations"
  • 裸露、性感、情色、内衣、暧昧亲密、床戏、诱惑等
④ 暴力 / 危险 / 血腥 高危
"dangerous situations" / "可能涉及危险情况"
  • 暴力、血腥、武器、打斗、战争、爆炸
  • 自杀、自残、事故、伤口、尸体、虐待
  • 危险动作 / 危险情境
⑤ 受保护版权(IP / 品牌) 版权
"protected intellectual property" / "受保护知识产权"
  • 动漫游戏角色:皮卡丘、马里奥、奥特曼、米老鼠、艾莎、蜘蛛侠、哆啦A梦、火影等
  • 品牌商标:Nike、苹果、迪士尼、可口可乐、LV 等任何 logo
  • 影视形象:具名电影/电视剧角色、海报、截图
⑥ 其他敏感主题 易忽略
  • 医疗病症:皮肤病、痤疮、湿疹、体味、伤口、疾病 ← 真实案例踩过
  • 政治 / 宗教:领导人、宗教冲突、种族议题
  • 毒品 / 违法:毒品、吸毒等
  • 仇恨 / 歧视言论

三、安全改写对照表

❌ 高危写法✅ 安全改写
超写实真人 + 正脸特写改 3D动画 / 插画 / 卡通 风格;或侧面、背面、远景
上传真人照片生成不要正脸;用远景/侧背面;或转动漫/卡通风格
奥特曼大战怪兽「一个通用的巨人英雄」(不点名具体 IP)
情侣处理痤疮/皮肤病去掉病名,改成中性的「情侣约会」
小孩在火边玩耍改成「成年人」,或移除危险元素
含名人姓名改成「一位虚构的人物」

四、万能保险公式

不确定会不会被拒时,套这个组合最稳:

非写实风格 (non-photorealistic / 3D cartoon / illustration / anime)
+ 虚构、不具名的主体 (fictional, non-identifiable subject)
+ 脸部不可识别 (背面 / 侧面 / 远景)
+ 内容健康、无版权

五、提交前自检清单

✅ 提交前过一遍,一次成功率最高
  • ☐ 有没有真人/名人?→ 转非写实风格或脸部不可识别
  • ☐ 有没有儿童/青少年?→ 移除或改成年人
  • ☐ 有没有性/暴力/危险/血腥?→ 删除相关描述
  • ☐ 有没有动漫角色/品牌/影视 IP?→ 换原创通用描述
  • ☐ 有没有病症/政治/毒品等敏感词?→ 中性化
  • ☐ 参考图是不是真人照片?→ 换非写实图或远景
💡 两类报错要分清
「temporarily unavailable / 暂时不可用」 → 后端临时波动,可稍后重试
「didn't pass content review / 没通过内容审查」 → 确定性拒绝,必须改内容,重试无用

MiniMax H3 视频生成

基于 MiniMax minimax-h3 的视频生成服务:1440P 超清 + 原生音频,支持文生视频、图生视频(多参考图)、首尾帧过渡、参考音频。异步创建 → 轮询 → 下载,与其它视频模型同一套 /v1/videos 接口。

模型与价格 · 按次固定

模型清晰度能力价格(按次)duration 范围
minimax-h31440P文生 / 图生(≤5 图)/ 首尾帧 / 参考音频,自带原生音频¥3.50/次5-15 秒(任意整数)
按次计费:每次提交固定 ¥3.50,与时长无关固定 1440P + 原生音频失败不计费

生成模式(按传入素材自动判定)

模式用途最少必传说明
1 文生视频纯文字生成prompt只传 prompt,不带素材
2 图生视频图驱动,可多参考图prompt + ≥1 张图referenceImages 数组(1~5 张);不能与首尾帧同用
3 参考音频按音频情绪 / 口型生成prompt + ≥1 张图 + referenceAudios音频 ≤3 个、合计 ≤15 秒;须至少配 1 张参考图
4 首尾帧开始画面 → 结束画面过渡prompt + first_image + last_image(成对)须成对;不能与普通参考图同用

参数

字段类型必填说明
modelstring固定 minimax-h3
promptstring提示词,≤ 2000 字符
durationinteger建议5-15 任意整数,缺省 5(按次计费,与时长无关)
ratiostring建议画幅:16:9 / 1:1 / 9:16 / 21:9 / 4:3 / 3:4,缺省 16:9
resolutionstring固定 1440p(可不传)
generate_audioboolean原生音频,缺省 true
referenceImagesstring[]参考图 ≤5;公网 URL 或 data:image/...;base64,
referenceAudiosstring[]参考音频 ≤3、合计 ≤15 秒;须至少配 1 张参考图
first_image / last_imagestring首/尾帧(成对);不能与 referenceImages 同用

示例:文生视频

curl https://newapi-2.oairegbox.cc/v1/videos \
  -H "Authorization: Bearer $TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "minimax-h3",
    "prompt": "A calm ocean wave rolling onto a sandy beach at golden sunset, cinematic wide shot, gentle motion",
    "duration": 5,
    "ratio": "16:9",
    "resolution": "1440p",
    "generate_audio": true
  }'

返回任务对象(含 task_id,初始 status:"queued")。

示例:图生视频 / 首尾帧

# 图生视频(参考图 ≤5)
{"model":"minimax-h3","prompt":"...","duration":5,"ratio":"16:9",
 "referenceImages":["https://.../a.png","https://.../b.png"]}

# 首尾帧过渡(成对,不能再带 referenceImages)
{"model":"minimax-h3","prompt":"...","duration":8,"ratio":"16:9",
 "first_image":"https://.../start.png","last_image":"https://.../end.png"}

轮询 & 下载

# 轮询任务(前 60 秒每 3-5 秒一次,之后每 10-15 秒)
curl https://newapi-2.oairegbox.cc/v1/videos/TASK_ID -H "Authorization: Bearer $TOKEN"

# status=completed 后,用响应里的 video_url 直链下载
curl -L "VIDEO_URL" -o result.mp4
注意
不支持参考视频referenceVideos),传入会失败。
• 参考音频必须搭配 ≥1 张参考图;参考图与首尾帧不能同时使用
progress 长时间不动不代表卡住——只要 status 仍是 queued/in_progress 就继续轮询;到 completed/failed 停止。
• 15 秒长视频出片时间较长,请耐心轮询。失败不计费。

MiniMax H3 · 按秒计费(768P / 2K)

MiniMax H3 的按秒计费版本,两档清晰度,原生音频。支持文生视频、图生视频、首尾帧过渡与参考图 / 参考音频驱动;需要参考视频驱动请用下方 Pro 档。与其它视频模型同一套 /v1/videos 接口:异步创建 → 轮询 → 下载。

📌 全能参考 = 图·视频·音频 支持张数(如 933 = 9 图 + 3 视频 + 3 音频,对标 Seedance 2.0)。如需 933 全能参考,请联系客服开通。

模型与价格 · 按秒

模型清晰度全能参考价格时长能力
minimax-h3-768p768P503¥0.15/秒4–15 秒文生 / 图生 / 首尾帧 / 参考图 / 参考音频,原生音频
minimax-h3-2k2K503¥0.20/秒4–15 秒同上,2K 超清
按秒计费 = 单价 × 时长(例:minimax-h3-2k 跑 10 秒 = ¥2.00;minimax-h3-768p 跑 6 秒 = ¥0.90)。失败不计费。

生成模式(按传入素材自动判定)

模式最少必传说明
文生视频prompt纯文字生成
图生视频prompt + 参考图referenceImages(≤5 张)
首尾帧first_image(+ last_image首帧 / 首尾帧过渡;不能与普通参考图同用

参数

字段类型说明
modelstringminimax-h3-768pminimax-h3-2k
promptstring提示词,≤ 7000 字符
durationinteger4–15 秒(按秒计费)
ratiostring16:9/9:16/1:1/21:9/4:3/3:4/adaptive(文生视频不支持 adaptive)
referenceImagesstring[]参考图 ≤5(公网 URL 或 base64)
referenceAudiosstring[]参考音频 ≤3(须配参考图;合计 ≤15 秒)
first_image / last_imagestring首/尾帧;不能与 referenceImages 同用

示例:文生视频

curl https://newapi-2.oairegbox.cc/v1/videos \
  -H "Authorization: Bearer $TOKEN" -H "Content-Type: application/json" \
  -d '{"model":"minimax-h3-2k","prompt":"A calm ocean wave at golden sunset, cinematic","duration":5,"ratio":"16:9"}'

示例:图生视频(参考图)

curl https://newapi-2.oairegbox.cc/v1/videos \
  -H "Authorization: Bearer $TOKEN" -H "Content-Type: application/json" \
  -d '{"model":"minimax-h3-768p","prompt":"角色转身微笑,镜头缓慢推近","duration":6,
       "referenceImages":["https://.../ref1.jpg"]}'

Pro 档 · 参考视频驱动

需要用一段视频驱动动作 / 镜头运动时,改用 Pro 档:在上面全部能力之上,额外支持 1 段参考视频

模型清晰度全能参考价格时长说明
minimax-h3-pro-768p768P913¥0.22/秒4–15 秒基础能力 + 参考视频
minimax-h3-pro-2k2K913¥0.33/秒4–15 秒同上,2K 超清
参考视频:1 段,时长 2–5 秒(请上传你需要的关键片段);放进 referenceVideos,可叠加参考图 / 参考音频 / 首尾帧。价格已含参考视频处理,按输出秒数计费、失败不计费。2K / 参考视频出片较慢,高峰期偶发排队请重试。

示例:参考视频驱动(Pro)

curl https://newapi-2.oairegbox.cc/v1/videos \
  -H "Authorization: Bearer $TOKEN" -H "Content-Type: application/json" \
  -d '{"model":"minimax-h3-pro-768p","prompt":"角色跟随参考视频的动作与镜头运动","duration":5,
       "referenceVideos":["https://.../ref.mp4"]}'

轮询 & 下载

curl https://newapi-2.oairegbox.cc/v1/videos/TASK_ID -H "Authorization: Bearer $TOKEN"
# status=completed 后用响应里的 video_url 直链下载
curl -L "VIDEO_URL" -o result.mp4
参考素材可用公网 URL 或 base64;轮询到 completed/failed 停止;失败不计费。