APIリファレンス

SeeDance 動画生成

TENSORAXIS を通じて Volcengine Ark Doubao Seedance モデルを呼び出す — テキストから動画、画像から動画、最初/最後のフレーム、動画参照/継続、および metadata の高度なパラメータと課金について。

SeeDance は、Volcengine Ark Doubao Seedance 動画モデル(チャネル doubao-video)を TENSORAXIS に統合したものです。他の動画モデルと同様に非同期で動作します。タスクを送信して task_id を取得し、タスクのステータスをポーリングした後、完了後に動画の URL を読み取ります。共通の送信/ポーリングのフローは 動画生成の概要 にあります。このページでは SeeDance 固有の機能とパラメータのみを扱います。

TENSORAXIS のリクエストフィールド promptimagesmetadata を使用してください。リレーがこれらを Volcengine のコンテンツ生成タスクの形式に変換します。アップストリームのトップレベル content[] ボディを直接 /v1/video/generations に送信しないでください。そうすると TENSORAXIS は prompt を見つけられず、400 prompt is required を返します。

モデルと機能マトリックス

モデルテキストから動画画像から動画(最初のフレーム)最初/最後のフレームマルチモーダル参照(画像/動画/音声)ネイティブ音声
doubao-seedance-1-0-lite-t2v
doubao-seedance-1-0-lite-i2v
doubao-seedance-1-0-pro-250528
doubao-seedance-1-5-pro-251215
doubao-seedance-2-0-260128
doubao-seedance-2-0-fast-260128

2-0-fast は機能面で 2-0 と同等ですが、より高速な生成に最適化されています。機能のサポート状況は最終的にアップストリームのモデルによって定義されます。

リクエストフィールド

POST /v1/video/generations

フィールド必須説明
modelstring必須SeeDance モデル名(上記の表を参照)
promptstring必須動画のプロンプト。空の場合は 400 prompt is required を返す
imagesstring[]任意画像から動画(最初のフレーム)用の参照画像 URL。複数の参照もここに指定する
imagestring任意単一の参照画像 URL。images が空の場合は images に正規化される
secondsstring任意秒単位の長さ。正の整数はアップストリームの duration にマッピングされ、metadata.duration と同等
metadataobject任意SeeDance の高度なパラメータ — metadata の高度なパラメータ を参照

テキストから動画

prompt のみを指定します。解像度、長さ、アスペクト比などは metadata 経由で追加します。

curl https://api.tensoraxis.com/v1/video/generations \
  -H "Authorization: Bearer $TENSORAXIS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "doubao-seedance-2-0-260128",
    "prompt": "An old man wearing a hat smiles and walks forward down an autumn street",
    "metadata": {
      "resolution": "1080p",
      "ratio": "16:9",
      "duration": 5
    }
  }'

画像から動画

最初のフレーム

images 経由で参照画像を渡すと、それが最初のフレームとして使用されます。その他のパラメータはテキストから動画と同じです。

curl https://api.tensoraxis.com/v1/video/generations \
  -H "Authorization: Bearer $TENSORAXIS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "doubao-seedance-1-0-lite-i2v",
    "prompt": "Slow push-in, the subject smiles",
    "images": ["https://example.com/first-frame.jpg"],
    "metadata": {
      "resolution": "1080p",
      "duration": 5
    }
  }'

最初/最後のフレーム(Seedance 2.0)

最初/最後のフレームを使うには、metadata.content で各画像に明示的な rolefirst_frame / last_frame)を付与する必要があります。これは images から生成されるコンテンツリストを上書きします。metadata.content の形式 を参照してください。

{
  "model": "doubao-seedance-2-0-260128",
  "prompt": "A time-lapse from dawn to sunset",
  "metadata": {
    "resolution": "1080p",
    "duration": 5,
    "content": [
      { "type": "image_url", "image_url": { "url": "https://example.com/start.jpg" }, "role": "first_frame" },
      { "type": "image_url", "image_url": { "url": "https://example.com/end.jpg" }, "role": "last_frame" }
    ]
  }
}

動画参照/継続(「動画編集」に相当)

SeeDance のバックエンドにはフレームレベル専用の動画編集エンドポイントはありません。Seedance 2.0 の「動画マルチモーダル参照」機能を使うと、動画を参照/継続のソースとして与えることができます — video_url を持つ metadata.content アイテムを渡してください。

{
  "model": "doubao-seedance-2-0-260128",
  "prompt": "Continue the motion in this clip, the camera keeps panning right",
  "metadata": {
    "resolution": "1080p",
    "content": [
      { "type": "video_url", "video_url": { "url": "https://example.com/source.mp4" } }
    ]
  }
}

リクエストに動画入力が含まれる場合、TENSORAXIS は(metadata の宣言ではなく)実際のメディアコンテンツに基づいてそれを「動画入力」として分類し、より安価な階層で課金します — 課金 を参照してください。フレームレベルの動画編集(特定のセグメントの置き換え/再描画)が必要な場合は、代わりに HappyHorse 動画編集happyhorse-1.0-video-edit)を使用してください。

metadata の高度なパラメータ

metadata 配下のフィールドは、Volcengine タスクのトップレベルフィールドにマッピングされます。「範囲 / デフォルト」列は Volcengine の公式ドキュメントに基づいており、最終的にはアップストリームのモデルによって定義されます。TENSORAXIS はこれらのフィールドを受け取って転送するだけです。

フィールド転送先範囲 / デフォルト説明
resolutionresolutionstring480p / 720p / 1080p / 2k、デフォルト 1080p出力解像度
ratioratiostring16:9 / 9:16 / 4:3 / 3:4 / 21:9 / 1:1 / adaptiveアスペクト比
durationdurationinteger415、デフォルト 5秒単位の長さ。トップレベルの seconds と同等
framesframesintegerモデル定義総フレーム数(fps/長さに連動)
seedseedintegerランダムシードランダム性を固定して結果を再現する
camera_fixedcamera_fixedbooleanデフォルト falseカメラを固定するかどうか
watermarkwatermarkbooleanデフォルト false透かしを追加するかどうか
generate_audiogenerate_audiobooleanデフォルト falseネイティブ音声を生成する(Seedance 2.0)
return_last_framereturn_last_framebooleanデフォルト false最後のフレーム画像を返す
draftdraftbooleanデフォルト falseドラフト/プレビューモード
service_tierservice_tierstringモデル定義サービス階層
execution_expires_afterexecution_expires_afterintegerモデル定義タスクの有効期限(秒)
callback_urlcallback_urlstringタスク完了時のコールバック URL
toolstoolsarrayツール設定(例:ウェブ検索)
contentcontentarray高度なコンテンツ配列、詳細は下記参照

補足:

  • metadata.model は削除され、課金対象のモデルを上書きすることはできません。
  • 上記のフィールドにマッピングされていない metadata のキーは、通常アップストリームに転送されません。
  • secondsmetadata.duration の両方が送信された場合、metadata.duration が優先されます。

metadata.content の形式

metadata.content は、最初/最後のフレーム、動画参照、音声参照などに使用される高度なコンテンツ配列です。一度指定すると、images から生成されるコンテンツリストを上書きしますtype: text のアイテムは無視され、本文は prompt から取得されます)。

アイテムタイプフィールド公式の制約(アップストリーム定義)
image_urlimage_url.url、任意の role画像 ≤30MB、≤9 アイテム。role は最初/最後のフレーム用
video_urlvideo_url.url動画 2–15秒、≤3 クリップ
audio_urlaudio_url.url音声 ≤15MB、≤3 クリップ
texttext無視される。本文はトップレベルの prompt から取得される

課金

SeeDance はトークン単位で課金されます。解像度はすでにトークン数に反映されているため、別途解像度係数は適用されません。

  • 通常の生成(テキスト/画像から動画)は generate 階層を使用します。
  • 動画入力(動画参照/継続)は実際のメディアコンテンツから検出され、より安価な video_input 割引階層に分類されます(通常の生成より単価が低くなります)。

正確な単価はコンソールの「動画料金」設定および料金ページに従います。運営者はデフォルト値を最新の公式レートで上書きできます。

タスクのポーリング

共通の送信/ポーリングフロー、ステータスコード、OpenAI/Sora 互換の取得パスについては、動画生成の概要 を参照してください。