Générer une vidéo
Soumets un job vidéo en mode image-to-video, text-to-video ou text-to-video-styled.
mode sélectionne la forme de la
requête (image_to_video, text_to_video ou text_to_video_styled) et l’appel
renvoie 202 Accepted avec un id de job ; interroge
GET /videos/generations/{id} pour le
résultat. Consulte GET /videos/models pour
connaître la prise en charge de duration, resolution, aspect_ratio, frame de
fin et audio de chaque engine.
Exemple : image-to-video avec une frame de départ et de fin
En modeimage_to_video, image est la frame de départ et end_image une frame de
fin optionnelle (uniquement sur les engines qui prennent en charge la frame de fin —
voir supports_end_frame dans
GET /videos/models). Chaque frame prend
exactement un parmi image_id, url, ou base64 + mime_type.
duration est requis et doit être une valeur prise en charge par l’engine (voir
durations dans
GET /videos/models) — une valeur non
prise en charge renvoie 422. Pour text_to_video_styled, style_id est requis
aux côtés de prompt et duration ; le menu déroulant du corps de requête
ci-dessus montre les trois modes.Autorisations
Organization API key as a bearer token: Authorization: Bearer samsa_sk_....
Corps
- PublicImageToVideoRequest
- PublicTextToVideoRequest
- PublicTextToVideoStyledRequest
mode: image_to_video — animate a start frame (optional end frame).
Clip length in seconds. Each engine supports a specific set — see durations in GET /videos/models. Unsupported values return 422.
8
The start frame: exactly one of image_id, url, or base64+mime_type.
Video engine — a public engine id from GET /videos/models (e.g. veo_3_1_lite, the default). Unknown engines return 422.
"veo_3_1_lite"
Aspect ratio — 16:9, 9:16, or 1:1 (engine-dependent; see aspect_ratios in GET /videos/models).
"16:9"
Output resolution — 720p, 1080p, or 4k where the engine supports it (see resolutions in GET /videos/models). Omit to use the engine default. Credits scale with the engine's resolution multipliers.
"720p"
Generate audio with the video — audio-capable engines only (see supports_audio in GET /videos/models); adds the engine's audio credit multiplier.
false
Optional https webhook notified once on terminal status (signed per the webhook signature scheme; see the webhooks docs).
"https://example.com/webhooks/samsa"
"image_to_video"Optional end frame — only for end-frame-capable engines (see supports_end_frame in GET /videos/models).
Optional text prompt guiding the motion.
1"The camera slowly pans right as waves roll in"
Réponse
Successful Response
202 body for POST /videos/generations (ADR §7.1).
The video job id — poll GET /videos/generations/{id}.
Initial status: always pending at submit.
pending, processing, completed, failed, cancelled "pending"
The requested mode — image_to_video, text_to_video, or text_to_video_styled.
"text_to_video"
Credits this job is expected to cost (base 5/sec x engine multiplier x resolution x audio; styled adds a flat 10 for the intermediate image).
80

