← Le LiveIA CODE LIVE
ARTICLE Par

Image et vidéo entrent dans les mêmes pipelines API que les LLM

Illustration éditoriale — Image et vidéo entrent dans les mêmes pipelines API que les LLM

Les modèles visuels quittent les interfaces de démonstration pour devenir des briques directement appelables dans les produits. Alibaba expose Wan 2.7 par API pour générer, éditer et combiner plusieurs images ; Vercel ajoute Muse Image à son AI Gateway. Le même workflow peut désormais choisir un modèle visuel comme il choisit un LLM.

Cette industrialisation ne concerne plus seulement l’image fixe. Kira 5.7 met à jour ses modèles vidéo Nova et Ultra, avec génération et édition renforcées et des temps annoncés d’environ une minute sur Ultra. Côté développeurs, le point commun est la réduction des étapes entre prompt, référence visuelle, génération puis nouvelle édition.

Pour les équipes produit, la conséquence est concrète : image et vidéo entrent dans les mêmes pipelines programmables que le texte. Les API acceptent des références, conservent davantage de contexte d’édition et exposent coût ou vitesse comme paramètres de choix. Il devient possible de construire un workflow multimodal sans enfermer toute la chaîne dans un seul outil créatif.

Références

Sources

Chaque onglet présente la publication d’origine et son lien direct.

Alibaba Cloud Model Studio

Wan2.7 - image generation and editing

La référence API de Wan 2.7 documente génération, édition, séries d’images et références multiples. La version Pro monte à 4K en text-to-image et propose des appels synchrones ou asynchrones dans Model Studio.

Ouvrir la source ↗