Blogue

Veo 3.1 dans Kollab : le modèle vidéo #1 de Google

20 mai 2026frYANAI Insights11 min read

Veo 3.1 domine Video Arena. Kollab l’intègre comme modèle vidéo par défaut : chaînes au-delà de 8 secondes, image-to-video et audio natif sans configurer Vertex AI.

Veo 3.1Google Veo 3.1Kollabvidéo AIimage-to-videoVertex AI

Il y a quelques semaines, Google DeepMind a été expédiéVeo 3.1, et les classements n'ont pas tardé à réagir. Arena.ai l'a appelé lepremier modèle à franchir 1400 en Video Arena, avec un bond de 30 points par rapport à Veo 3.0 en une seule version – en tête des tableaux texte-vidéo et image-vidéo.

Google DeepMind lancement Veo 3.1, 15 octobre 2025 — @GoogleDeepMind le X

Si vous avez observé l'espace, vous savez déjà ce que cela signifie : le plafond a bougé.

Kollab a déjà Veo 3.1 câblé commedéfautmodèle vidéo. Aucun projet GCP à mettre en place. Aucun compte de service Vertex AI à gérer. Aucun revendeur de crédit tiers au milieu. Tapez votre invite dans n'importe quelle tâche, et pareilveo-3.1-generate-001le modèle dont parle le classement exécute le travail.

Cet article explique ce qui a changé dans Veo 3.1, ce que les créateurs de X et Reddit font réellement avec, et les deux choses que Kollab fait en plus : enchaîner au-delà de la limite de 8 secondes et transformer n'importe quelle image de votre espace de travail en cadre d'ouverture.

Quoi de neuf dans Veo 3.1

Google DeepMindmessage de lancementle maintient serré :"Des contrôles créatifs améliorés pour les cinéastes, les conteurs et les développeurs, dont beaucoup avec audio."Les trois pièces qui comptent :

Le résultat est que Veo 3.1 a dépassé 1 400 le Video Arena. Le modèle précédent – Veo 3.0 – se situait à ~ 1370. Le saut a duré six mois.

Arena.ai : Veo 3.1 prend la première place sur les tableaux texte-vidéo et image-vidéo, +30 par rapport à Veo 3.0
Arena.ai : Veo 3.1 prend la première place sur les tableaux texte-vidéo et image-vidéo, +30 par rapport à Veo 3.0

Ce que les créateurs en font

Le signal le plus frappant n’est pas une référence : c’est ce que les gens ont construit au cours des trois premières semaines.

  • el.cine encore,23 octobre: "Google Veo 3.1 vient de tuer les agences de publicité. Vous pouvez désormais créer des publicités au niveau du studio en quelques secondes, en gardant la cohérence des acteurs, des tenues, des produits et de l'environnement."1 288 likes, 100 000 vues, les commentaires sont des personnes réservant des appels clients.
Démo publicitaire Veo 3.1 de el.cine — 1 288 j'aime, 100 000 vues sur X
Démo de cohérence multi-scènes Veo 3.1 de HeyGen
  • a16z Justine MooreenchaînésNano Banana → Veo 3.1 → ElevenLabs Studio pour un pipeline image-vidéo-audio de bout en bout. La forme du travail est passée de « rendre un clip » à « composer une séquence ».

  • Le signal viral : le r/singularity de Reddit a frappé3 521 votes positifssur un remake de Will Smith Spaghetti dans Veo 3.1. Pour le contexte : cette invite est la référence vidéo non officielle AI depuis 2023. Veo 3.1 est le premier modèle à ne pas paraître déséquilibré.

Si vous avez réalisé des vidéos avec Sora 2, Kling, Runway, Higgsfield, c'est sur ce modèle que les créateurs réservent réellement du travail commercial.

Les deux choses dont les gens continuent de se plaindre

Veo 3.1 n'est pas une victoire gratuite. Lisez r/VEO3 pendant dix minutes et vous verrez le modèle.

  1. Le plafond dur de 8 secondes.Chaque extrait de Veo 3.1 dure 8 secondes, point final. La propre équipe Gemini de Google l'a reconnu publiquement :"Les clips de 8 secondes de Veo 3.1 sont un point de départ... nous travaillons continuellement à les développer."Pour quiconque crée de véritables récits, publicités ou bandes-annonces, huit secondes ne sont pas un livrable.

  2. La taxe d'accès.Higgsfield, Arcads, HeyGen, Flow — chaque emballage vend Veo 3.1 par crédit, limite les promotions « illimitées » à des fenêtres de trois jours ou vous fait garder la chaîne Extend à la main. Le fil de discussion Reddit"Au revoir Veo 3.1"ce sont principalement des gens qui ont été facturés avant d’avoir obtenu une réduction utilisable.

Ces deux problèmes sont des problèmes de flux de travail et non de modèles. Quelle est la partie résolue par Kollab.

Ce que Kollab fait en plus de Veo 3.1

Kollab/veo-3la compétence appelle Vertex AI directement avecveo-3.1-generate-001comme valeur par défaut pour la génération initiale et Extend. Tout ce qui suit fonctionne dans n'importe quelle tâche Kollab, sans configuration supplémentaire :

  • Enchaînez automatiquement au-delà du plafond de 8 secondes.Une commande -chaîne veo3 "votre invite" --target-duration 30— génère le premier segment de 8 secondes, puis émet des tâches Extend qui alimentent chaque clip comme source du suivant. Jusqu'à ~ 30 secondes par chaîne. L'historique des tâches conserve chaque segment intermédiaire et la tâche finale fusionnée, afin que vous puissiez choisir à nouveau un point médian sans redémarrer.

  • Conversion d'image en vidéo à partir de n'importe quel artefact de l'espace de travail.Déposez une image dans la tâche (un cadre Nano Banana, un rendu GPT Image 2, une photo que vous avez téléchargée) et référencez-la comme--first-frame-ref artefact :<id>. Pas de jonglerie avec les URL signées. Le serveur résout l’artefact et transmet les octets propres à Vertex.

  • Ambiance/dialogue/SFX natif activé par défaut.L'audio de Veo 3.1 est activé dans la configuration d'exécution du serveur de compétences, et non basculé par appel.

  • Non GCP, pas de compte de service, pas de code d'interrogation.Le serveur de compétences de Kollab possède les informations d'identification Vertex, l'interrogation des opérations, le déplacement de l'artefact GCS-to-S3, la facturation - votre tâche obtient simplement un MP4 final en artefacts.

  • Tous les segments persistent sous forme d'artefacts.L'historique des tâches longue montre chaque segment ainsi que la vidéo finale. Si une chaîne prend un mauvais virage au segment 3, vous ré-invitez à partir du segment 2 sans reconstruire à partir de zéro.

Vous ne choisissez pas de modèle. Vous ne choisissez pas de fournisseur. Vous ne choisissez pas de durée d'exécution vidéo. Vous écrivez ce que vous voulez et Veo 3.1 le génère.

Trois invites à essayer dès maintenant

Dans n'importe quelle tâche Kollab :

"make a Veo 3 video of a slow dawn flyover over a glass greenhouse,\nwarm natural audio, slight camera push-in"

Cela vous donne un clip 16:9 1080p de 8 secondes avec un son natif. Un seul travail.

Run this prompt in Kollab
Open Kollab and run this prompt with Veo 3.1 — no setup, native audio on by default.
make a Veo 3 video of a slow dawn flyover over a glass greenhouse, warm natural audio, slight camera push-in
Open task →
"make a 30-second Google Veo cinematic sequence:\ndawn flyover, into the greenhouse, condensation on the glass,\nsunrise hitting the orchids"

Cela déclenchechaîne veo3— premier segment plus trois extensions, cousues. La vidéo finale atterrit dans les artefacts en environ 6 à 8 minutes.

Run this prompt in Kollab
Open Kollab and run this prompt with Veo 3.1 — no setup, native audio on by default.
make a 30-second Google Veo cinematic sequence: dawn flyover, into the greenhouse, condensation on the glass, sunrise hitting the orchids
Open task →
"animate this hero frame into a 4-second premium product reveal\n(referencing the gpt-image-2 artifact in this task)"

Il s'agit d'une image vers une vidéo avec un artefact d'espace de travail comme image d'ouverture. Pas d'URL, pas de ré-upload.

Run this prompt in Kollab
Open Kollab and run this prompt with Veo 3.1 — no setup, native audio on by default.
animate this hero frame into a 4-second premium product reveal (referencing the gpt-image-2 artifact in this task)
Open task →

Pourquoi cela change l'unité de travail

Pendant deux ans, "AI vidéo" signifiait"Aller sur un site Web, choisir un modèle, acheter des crédits, demander, attendre, télécharger, changer d'outil pour ajouter de l'audio, changer d'outil pour étendre, changer d'outil pour livrer."Cinq onglets, quatre connexions, trois abonnements.

Le changement intéressant se produit lorsque le modèle vidéo le plus puissant au monde devient une ligne de langage naturel à l'intérieur de l'espace de travail dans lequel vous vous trouvez déjà – à côté de vos images, de vos scripts, de vos prises précédentes, de votre équipe. Il ne s'agit pas de « la vidéo AI en tant qu'outil ». Il s'agit de la vidéo AI en tant que primitive que votre tâche peut appeler.

Veo 3.1 est le modèle. Kollab est le runtime qui le transforme en travail.

Run Veo 3.1 in Kollab
No GCP setup. No 8-second cap. The leaderboard-topping video model is the default in any Kollab task.
Open a task →

FAQ

Qu'est-ce que Veo 3.1 ?Veo 3.1 est celui de Google DeepMindmodèle de génération vidéo, sorti le 15 octobre 2025. Ilclassé n°1 sur Video Arenapour le texte en vidéo et l'image en vidéo, avec un saut de 30 points par rapport à Veo 3.0 et le premier score de 1 400+ dans l'histoire de Video Arena. Il génère des clips de 8 secondes jusqu'à 1080p avec un son natif.

Veo 3.1 dans Kollab est-il le même modèle que le modèle officiel de Google ?Oui. Kollab appelle Vertex AI avecveo-3.1-generate-001— le même modèle GA sur le API de Google. La génération, l'extension, l'audio, le rapport et la résolution se comportent de manière identique au modèle officiel.

Puis-je créer des vidéos de plus de 8 secondes avec Veo 3.1 ?Grâce aux vidéos officielles Veo 3.1 API ou Google, non : chaque clip est limité à 8 secondes. Kollab comprend unchaîne veo3commande qui émet automatiquement des tâches Extend et alimente chaque segment comme source du suivant, jusqu'à environ 30 secondes par chaîne.

Ai-je besoin d'un projet Cloud Google ou d'un accès Vertex AI ?Non. Le serveur de compétences de Kollab possède les informations d'identification, l'interrogation et le téléchargement d'artefacts de Vertex AI. Vous écrivez uniquement l'invite.

Le Veo 3.1 de Kollab prend-il en charge l'image vers la vidéo et Extend ?Oui. Transmettez n'importe quel artefact de tâche en tant que--first-frame-ref artefact :<id>pour la conversion d'image en vidéo, ou utilisezveo3 extend "..." --source-video-job-id <previous-job-id>pour continuer un clip existant. La chaîne combine les deux.

En quoi est-ce différent de Higgsfield, HeyGen ou Arcads ?Ces produits incluent Veo 3.1 derrière des packs de crédits, une tarification par clip et des interfaces autonomes. Kollab appelle le même modèle directement à partir de n'importe quelle tâche sur laquelle vous travaillez déjà – aux côtés de vos scripts, images, prises antérieures et du reste de votre espace de travail – avec chain et Extend intégrés dans une seule commande.

Qu’en est-il des prix ?Les générations Veo 3.1 dans Kollab consomment des crédits de tâche comme toutes les autres tâches longues dans l'espace de travail. Il n’y a pas de packs de crédits distincts à acheter ni de limitations tierces.


Sources : [@GoogleDeepMind](https://x.com/GoogleDeepMind/status/1978491999029219364); (lancement), [Arena.ai](https://x.com/arena/status/1980319296120320243); (classement), [@bilawalsidhu](https://x.com/bilawalsidhu/status/1978497357760311500);, [@EHuanglu](https://x.com/EHuanglu/status/1981351877116879196);, [@HeyGen](https://x.com/HeyGen/status/1979220312438055018);, [@venturetwins](https://x.com/venturetwins/status/1988291582337098219);, [@GeminiApp](https://x.com/GeminiApp/status/1998528052901388324);, [r/singularity](https://www.reddit.com/r/singularity/comments/1o7psz2/will_smith_eating_spaghetti_in_veo_31/).; Le texte cité appartient aux auteurs originaux ; les références sont des commentaires.

Continuer à explorer ce sujet

Utilisez ces pages suivantes pour passer de l’article aux détails produit, comparaisons et exemples de workflows.

Articles liés