Skip to main content
Pour une nouvelle intégration, utilisez Génération de vidéos avec le protocole unifié /ai/v1/videos. L’interface compatible /v1/videos reste disponible. Consultez l’API Schema du modèle, sélectionnez l’endpoint par son path et lisez son request.schema sans dépendre de l’ordre du tableau.

Inventaire actuel des modèles

Cet inventaire indique les modèles actuellement disponibles. Il ne signifie pas que tous acceptent les mêmes champs. Sélectionnez l’endpoint par path dans le Schema du modèle, puis lisez son request.schema.

API

Description détaillée de l’API

En-têtes de requête

Créer une tâche de génération vidéo

Corps de la requête

Le format de réponse varie légèrement selon le modèle, mais tous contiennent les champs id (video_id) et status. Il suffit de se fier à status pour suivre la progression de la tâche.

Exemple de réponse (Tongyi Wanxiang/Veo/Jimeng AI)

Exemple de réponse (Sora)

Description des valeurs de statut communes

Interroger le statut de la vidéo

Interrogez cette interface pour vérifier si la tâche est terminée. Il est recommandé d’interroger toutes les 15 secondes.

Exemple de réponse (génération terminée - Tongyi Wanxiang)

Exemple de réponse (génération terminée - Sora)

Tous les modèles déterminent l’état d’achèvement via status == "completed", puis appellent l’interface /content pour télécharger.

Télécharger le contenu de la vidéo

Une fois le statut passé à completed, appelez cette interface pour télécharger le fichier vidéo MP4. Réponse : renvoie directement le flux binaire de la vidéo (Content-Type: video/mp4).
Remarque : le lien de téléchargement de la vidéo a généralement une validité de 24 heures, veillez à télécharger et à sauvegarder à temps.

Supprimer une tâche vidéo

Cette interface permet de supprimer une tâche vidéo déjà créée.

Détail des paramètres par modèle

OpenAI Sora

Astuce : le paramètre seconds de tous les modèles est toujours passé sous forme de chaîne (par ex. "8").
Exemple

Google Veo

Exemple
Notes sur les champs image :
  • Priorité de la première trame : first_frame > input_reference (trame unique compatible OpenAI).
  • Chaque élément de first_frame / last_frame / reference_images accepte : une URL publique, une data URL base64 (data:image/png;base64,...), ou un objet {"mime_type":"image/png","data":"<base64>"}.
  • Les alias de style OpenRouter frame_images (éléments avec frame_type: first_frame | last_frame) et input_references sont également acceptés.
  • Jusqu’à 3 images de référence ; au-delà, une erreur 400 est renvoyée.
Astuce : Veo prend en charge la génération audio native, vous pouvez décrire les effets sonores dans le prompt, par ex. « chant d’oiseaux en fond », « mélodie de piano ».

Tongyi Wanxiang

Durées prises en charge par modèle Résolutions prises en charge (largeur*hauteur)
Remarque : wan2.6 ne prend en charge que 720P et 1080P ; wan2.5 prend en charge 480P, 720P, 1080P ; wan2.2 ne prend en charge que 480P et 1080P.
Exemple
Astuce : wan2.5 et versions ultérieures génèrent par défaut des vidéos sonores (doublage automatique), les prompts en chinois donnent de meilleurs résultats.

Doubao Seedance

Types de référence pris en charge par extra_body.content Exemple
Seedance 2.0 / 2.0 Fast

Kling

Cet inventaire indique les modèles actuellement disponibles. Il ne signifie pas que tous acceptent les mêmes champs. Sélectionnez l’endpoint par path dans le Schema du modèle, puis lisez son request.schema.

Exemple d’appel complet

FAQ

Combien de temps prend la génération vidéo ?

La génération vidéo prend généralement 1 à 5 minutes, le temps exact dépend du modèle, de la résolution et de la durée. Il est recommandé de définir un intervalle d’interrogation de 15 secondes.

Comment utiliser le paramètre input_reference ?

input_reference est utilisé pour les scénarios image vers vidéo, et prend en charge trois modes de passage :

Quelle est la durée de validité du lien de téléchargement de la vidéo ?

Le lien de téléchargement de la vidéo générée a généralement une validité de 24 heures, veillez à télécharger et à sauvegarder à temps.

Quelles différences pour le paramètre seconds selon les modèles ?

> Astuce : le paramètre seconds de tous les modèles est toujours passé sous forme de chaîne (par ex. "8"), l’API le traite automatiquement.

Quelles différences de format pour le paramètre size selon les modèles ?

Quelle est la différence entre seconds et duration ?

Les deux ont la même signification et désignent tous deux la durée de la vidéo. L’API prend en charge ces deux noms de paramètre (sauf Sora, qui n’accepte que seconds). Il est recommandé d’utiliser systématiquement seconds.

Comment écrire un meilleur prompt ?

  • Décrire une scène concrète : inclure le sujet, l’action, l’environnement, la lumière, l’ambiance
  • Spécifier le langage de caméra : par ex. « gros plan », « vue aérienne », « travelling avant », « ralenti »
  • Décrire le style : par ex. « cinématographique », « style documentaire », « style animation »
  • Les modèles chinois donnent de meilleurs résultats avec un prompt en chinois : Tongyi Wanxiang est optimisé pour le chinois
  • Veo prend en charge la description audio : vous pouvez décrire les sons dans le prompt, par ex. « chant d’oiseaux », « mélodie de piano »

Que faire en cas d’échec de la tâche ?

Lorsque status est failed, le champ error de la réponse contient les informations sur l’erreur :

Les causes courantes d’échec incluent : contenu non conforme, prompt trop long, format d’image non pris en charge, etc. Veuillez ajuster en fonction du message d’erreur puis réessayer.

Dernière mise à jour : 2026-06-01