新規連携では 動画生成 と統一
/ai/v1/videos プロトコルを使用してください。本ページの /v1/videos 互換インターフェースとモデルアダプターは引き続き利用できます。呼び出し前に モデル Schema API を照会し、返された path でプロトコルを選択して、その項目の request.schema を確認してください。配列順序には依存しないでください。現在のモデル一覧
この一覧は現在利用可能なモデルを示すもので、全モデルが同じ入力フィールドに対応することを意味しません。モデル Schema の
path でエンドポイントを選び、その項目の request.schema を確認してください。API 詳細説明
リクエストヘッダー
動画生成タスクの作成
リクエストボディ
モデルによってレスポンス形式に若干の違いがありますが、いずれもid(video_id)とstatusフィールドを含みます。statusでタスクの進捗を判断すればよいです。
レスポンス例(Tongyi Wanxiang/Veo/Jimeng AI)
共通ステータス値の説明
動画ステータスの照会
レスポンス例(生成完了 - Tongyi Wanxiang)
レスポンス例(生成完了 - Sora)
すべてのモデルはstatus == "completed"で完了状態を判断し、その後/contentインターフェースを呼び出してダウンロードします。
動画コンテンツのダウンロード
completed になったら、このインターフェースを呼び出して MP4 動画ファイルをダウンロードします。
レスポンス: 動画のバイナリストリームを直接返します(Content-Type: video/mp4)。
注意:動画のダウンロードリンクは通常 24 時間の有効期限があります。速やかにダウンロードして保存してください。
動画タスクの削除
このインターフェースは作成済みの動画タスクを削除するために使用します。各モデルのパラメータ詳細
OpenAI Sora
ヒント:すべてのモデルのサンプルsecondsパラメータは統一して文字列型で渡します(例:"8")。
Google Veo
サンプル
画像フィールドに関する注意:
- 先頭フレームの優先順位:
first_frame>input_reference(OpenAI 互換の単一フレーム)。 first_frame/last_frame/reference_imagesの各要素には、公開 URL、base64 データ URL(data:image/png;base64,...)、または{"mime_type":"image/png","data":"<base64>"}オブジェクトを指定できます。- OpenRouter 形式の
frame_images(frame_type: first_frame | last_frameを持つ要素)およびinput_referencesエイリアスも受け付けます。 - 参照画像は最大 3 枚まで;これを超えると 400 を返します。
ヒント:Veo はネイティブ音声生成をサポートしており、prompt 内で効果音を記述できます。例:「背景に鳥のさえずりが聞こえる」「ピアノの旋律」。
Tongyi Wanxiang
各モデルがサポートする長さ
サポートされる解像度(幅*高さ)
注意:wan2.6 は 720P と 1080P のみサポート;wan2.5 は 480P、720P、1080P をサポート;wan2.2 は 480P と 1080P のみサポート。サンプル
ヒント:wan2.5 以上のバージョンはデフォルトで音声付き動画を生成します(自動吹き替え)。中国語の prompt の方が効果が高いです。
Doubao Seedance
extra_body.content がサポートする参照タイプ
サンプル
Seedance 2.0 / 2.0 Fast
Kling
この一覧は現在利用可能なモデルを示すもので、全モデルが同じ入力フィールドに対応することを意味しません。モデル Schema の
path でエンドポイントを選び、その項目の request.schema を確認してください。完全な呼び出しサンプル
FAQ
動画生成にはどのくらい時間がかかりますか?
動画生成は通常 1-5 分かかり、具体的な時間はモデル、解像度、長さによって異なります。15 秒のポーリング間隔を設定することを推奨します。input_reference パラメータはどう使いますか?
input_reference は画像から動画のシナリオで使用し、3種類の渡し方をサポートします:
動画ダウンロードリンクの有効期限はどのくらいですか?
生成された動画のダウンロードリンクは通常 24 時間 の有効期限があります。速やかにダウンロードして保存してください。各モデルのseconds パラメータにはどんな違いがありますか?
> ヒント:すべてのモデルの
seconds パラメータは統一して文字列型で渡します(例:"8")。API が自動的に処理します。
モデルによってsize パラメータの形式にはどんな違いがありますか?
###
seconds と duration にはどんな違いがありますか?
両者の意味は同じで、どちらも動画の長さを表します。API はこの両方のパラメータ名をサポートしています(Sora を除く。Sora は seconds のみ受け付けます)。統一して seconds を使用することを推奨します。
より良い prompt を書くには?
- 具体的なシーンを描写する:主体、動作、環境、光線、雰囲気を含める
- カメラの言語を指定する:例「クローズアップ」「空撮」「ズームイン」「スローモーション」
- スタイルを描写する:例「映画的」「ドキュメンタリー風」「アニメ風」
- 中国語モデルには中国語 prompt の方が効果的:Tongyi Wanxiang は中国語に最適化されている
- Veo は音声記述をサポート:prompt 内で音を記述できる、例「鳥のさえずり」「ピアノの旋律」
タスクが失敗した場合の対処は?
status が failed の場合、レスポンスの error フィールドにエラー情報が含まれます: