HappyHorse 视频生成

通过 TENSORAXIS 调用阿里云百炼(DashScope)HappyHorse 系列:文生视频、图生视频、参考生视频与视频编辑四大能力,以及参数与计费说明。

HappyHorse 是阿里云百炼(DashScope)视频生成系列在 TENSORAXIS 上的接入,渠道 HappyHorse。它是异步任务:先提交任务取得 task_id,再轮询任务状态,完成后读取视频地址。提交与查询的通用流程见 视频生成总览,本页只讲 HappyHorse 特有的四种能力与参数。

四种能力按模型名后缀区分:

能力模型说明
文生视频(t2v)happyhorse-1.1-t2vhappyhorse-1.0-t2v仅凭提示词生成
图生视频(i2v)happyhorse-1.1-i2vhappyhorse-1.0-i2v基于 1 张首帧图生成
参考生视频(r2v)happyhorse-1.1-r2vhappyhorse-1.0-r2v基于多张参考图生成
视频编辑(video-edit)happyhorse-1.0-video-edit基于 1 段源视频 + 参考图编辑

本站入口字段

POST /v1/video/generations

字段类型必填说明
modelstringHappyHorse 模型名,见上表
promptstring视频提示词;为空返回 400 prompt is required
metadata.mediaarray视能力媒体输入数组,每项含 typeurltypefirst_frame / reference_image / video
imagesstring[]视能力参考图 URL(r2v 用);未带 metadata.media 时按参考图处理
imagestring视能力单张图 URL(i2v 首帧用)
input_referencestring视能力输入引用 URL(i2v 首帧 / r2v 参考图的兼容入口)
metadataobject分辨率、时长、画面比例等参数,见 参数

媒体输入推荐统一走 metadata.media,用 type 明确每项用途。images / image / input_reference 是兼容入口:未提供 metadata.media 时,i2v 取 input_reference/image 作首帧,r2v 取 images/input_reference 作参考图。视频编辑的源视频必须通过 metadata.mediatype: video)传入。

文生视频(-t2v)

仅需 prompt,不接受媒体输入。

curl https://api.tensoraxis.com/v1/video/generations \
  -H "Authorization: Bearer $TENSORAXIS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "happyhorse-1.1-t2v",
    "prompt": "雪山脚下的湖面倒映着晚霞,镜头缓慢推进",
    "metadata": {
      "resolution": "1080P",
      "ratio": "16:9",
      "duration": 5
    }
  }'

图生视频(-i2v)

恰好 1 张首帧图。可通过 metadata.mediatype: first_frame)传入,或用兼容入口 input_reference / image。不接受 ratio(画面比例由首帧决定)。

curl https://api.tensoraxis.com/v1/video/generations \
  -H "Authorization: Bearer $TENSORAXIS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "happyhorse-1.1-i2v",
    "prompt": "人物缓缓抬头微笑",
    "metadata": {
      "resolution": "1080P",
      "duration": 5,
      "media": [
        { "type": "first_frame", "url": "https://example.com/first-frame.jpg" }
      ]
    }
  }'

参考生视频(-r2v)

基于多张参考图生成。网关接受 1–9 张参考图(metadata.mediareference_image,或顶层 images);官方建议 ≤5 张,超出部分以上游返回为准。

curl https://api.tensoraxis.com/v1/video/generations \
  -H "Authorization: Bearer $TENSORAXIS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "happyhorse-1.1-r2v",
    "prompt": "让这几个角色在同一个场景里互动",
    "images": [
      "https://example.com/ref-1.jpg",
      "https://example.com/ref-2.jpg"
    ],
    "metadata": {
      "resolution": "1080P",
      "ratio": "16:9",
      "duration": 5
    }
  }'

视频编辑(-video-edit)

基于 1 段源视频做编辑。必须通过 metadata.media 传入恰好 1 个 type: video 的源视频;可附带参考图(type: reference_image,网关 ≤5 张,官方 ≤4 张)。

  • 不接受 duration:输出时长沿用源视频,因此不下发时长参数。
  • 支持 audio_setting(仅本能力):auto(默认)/ origin
curl https://api.tensoraxis.com/v1/video/generations \
  -H "Authorization: Bearer $TENSORAXIS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "happyhorse-1.0-video-edit",
    "prompt": "把背景替换成黄昏的城市天际线",
    "metadata": {
      "resolution": "1080P",
      "audio_setting": "origin",
      "media": [
        { "type": "video", "url": "https://example.com/source.mp4" },
        { "type": "reference_image", "url": "https://example.com/style.jpg" }
      ]
    }
  }'

参数

metadata 下的参数会映射为上游 DashScope 请求字段。「网关取值」为本站实际校验/钳制值;「官方说明」供参考,以上游返回为准

参数类型适用能力网关取值 / 默认说明
resolutionstring全部720P / 1080P,默认 1080P无法识别的值回退 1080P
ratiostring仅 t2v / r2v16:9 / 9:16 / 1:1 / 4:3 / 3:4;不传时上游默认 16:9i2v / video-edit 不接受
durationintegert2v / i2v / r2v钳制到 [3,15],默认 5video-edit 不接受(输出沿用源视频时长)
seedinteger全部[0, 2147483647]固定随机性;显式 0 会保留下发
watermarkboolean全部默认 false(显式下发)是否添加水印
audio_settingstring仅 video-editauto(默认)/ origin音频处理方式

duration 的官方范围因场景而异(文生约 [2,15]、含视频约 [2,10]),但网关统一钳制到 [3,15];越界值会被截到边界。

计费说明

HappyHorse 按秒计费,并乘以分辨率系数(1080P 约为 720P 的 1.78 倍)。

  • t2v / i2v / r2v 的时长在请求中已知,按实际时长 × 分辨率系数结算。
  • 视频编辑无 duration 入参(输出=源视频时长),按 metadata.duration 声明值计费;未声明时使用保守默认(约 10 秒)。

具体单价以控制台「视频计价」配置与定价页为准;运营可按最新官方价覆盖默认值。

任务查询

提交、轮询、状态码、OpenAI/Sora 兼容查询路径等通用流程,见 视频生成总览