D'une publicité Chanel valant plus de 30 millions de dollars à la séquence du naufrage du Titanic, des batailles de trône à une pluie de balles rebondissantes : une expérience visant à recréer les scènes les plus chères du cinéma en une nuit, sur un ordinateur portable domestique, avec l'IA. Dans cette vidéo, Tasarımcı Dayı met cela à l'épreuve sur cinq scènes, et la formule est toujours la même : reproduire le langage de caméra et l'échelle de l'original, laisser le reste au modèle. À mes yeux, la vraie revendication de la vidéo est économique plutôt que technique : peut-on approcher cette échelle sans plateaux, sans figurants et sans des mois de tournage ?
Première étape : le film Chanel No 5 avec Nicole Kidman, cité dans la vidéo avec un budget supérieur à 33 millions de dollars, alors que la presse de l'époque rapportait des chiffres autour de 42 millions. La séquence de fuite devant les paparazzis jusqu'à un taxi est générée en deux tentatives distinctes ; la poursuite fonctionne dans la première, tandis que la seconde cache le visage pour un cadre plus maîtrisé. L'accent mis sur l'asphalte mouillé par la pluie et le test des cinq doigts n'est pas un hasard : le fait que des modèles qui massacraient les mains il y a quelques années franchissent désormais ce cap montre le chemin parcouru dans la course au photoréalisme.
Le moment romantique sur le toit de la publicité devient une scène d'étreinte entre les mains du modèle, et les écarts comme la traîne exagérée de la robe sont montrés ouvertement. Ce qui frappe, c'est que l'outil ne s'arrête pas à une seule image et suggère au contraire de continuer avec des micro-directions comme s'appuyer sur une épaule, respirer, serrer l'étreinte : la génération évolue d'un simple visuel vers une mini-séquence. L'observation glissée par le créateur mérite aussi d'être notée : presque chaque publicité à l'écran porte désormais une mention « réalisé avec l'IA », et cette obligation révèle l'ampleur du boom côté production.
Côté Titanic, la barre est plus haute : la séquence du naufrage d'un film au budget total d'environ 200 millions de dollars est citée dans la vidéo comme un poste de 25 millions de dollars. Les premières tentatives échouent en chaîne : un côté du navire pend dans les airs, un morceau arraché tombe dans l'eau sans raison, une cheminée s'effondre, et dans certaines variantes le navire coule droit sans se briser. Partager ouvertement cette galerie d'échecs est le passage le plus honnête de la vidéo ; elle montre que le modèle ne sait pas distinguer « couler le navire » de « couler le navire en se brisant en deux ».
Même quand la séparation fonctionne, la physique s'effondre : sur le pont incliné, les figurants ne glissent ni ne tombent, les pieds d'un homme qui chute sont attachés à l'envers, la foule fond sur elle-même. Le créateur trouve la solution dans la distance : en reculant la caméra et en réduisant le navire à une silhouette, le moment de la séparation prend enfin la forme souhaitée. La leçon pratique se cache dans la boucle que la vidéo répète sans cesse : écrire le prompt, prendre le résultat, décrire l'erreur, régénérer ; et le fait qu'un prompt de naufrage en quatre parties soit rédigé par un agent montre que l'artisanat du prompt devient lui-même une couche sous-traitable.
Derrière toutes ces tentatives se tiennent deux noms : la plateforme Pollo AI, qui promet l'accès à des modèles comme Veo, Sora et Kling depuis un seul panneau, et Seedance 2.5, annoncé en juillet par l'équipe Seed de ByteDance. Le saut du modèle de 15 à 30 secondes définit directement le rythme de production de la vidéo ; deux sorties s'assemblent en un court-métrage d'une minute. Un vivier de 50 références composé de 30 images, 10 vidéos et 10 clips audio, plus des échanges d'objets uniques qui laissent le reste du cadre intact, sont les deux atouts majeurs de la plateforme. Une réserve de ma part : la remise de 60 pour cent mentionnée sur les crédits Seedance est une note de campagne temporaire, et les promesses de prix vieillissent vite dans ce type de contenu.
La Bataille des Bâtards de Game of Thrones est l'épisode où les chiffres parlent : 25 jours de tournage, 70 chevaux, 500 figurants, une équipe de 600 personnes, chaque reset prenant 25 minutes car il faut effacer les empreintes de sabots. Côté IA, les scènes de dégainage, de charge de cavalerie et d'affrontement sont étonnamment propres ; dans les moments chaotiques comme des lances volant dans les airs, le modèle semble se relâcher. Pas parfait : dans une image, une épée se duplique, mais des détails fins comme la buée du souffle suggèrent que les problèmes de cohérence ne sont plus aussi chroniques qu'avant.
La publicité Bravia de Sony en 2005, c'était 250 000 balles rebondissantes réelles lâchées dans une rue en pente de San Francisco ; l'adaptation stambouliote de la vidéo déplace la scène autour de Galata et Taksim. Le déluge de balles colorées dévalant les escaliers convainc sur la lumière et la masse ; pourtant un chat ignore la pluie de balles, un autre se vaporise en plein cadre, et des vols de pigeons inexpliqués apparaissent en arrière-plan. Le défaut structurel plus profond est que les balles apparaissent dans le cadre au lieu de tomber de quelque part : le modèle rend le résultat, pas la cause.
Dans la section en direct, la vidéo tente d'abord le moment où le Titanic frappe l'iceberg et commence à couler, en fournissant la photo du créateur comme référence et en tirant deux sorties en 480p ; la ressemblance du visage et la musique de tension fonctionnent, tandis que la seconde variante rate la cible. La scène de couloir où l'agent se glisse par une porte entrouverte est correcte en 5 secondes. La vraie casse vient avec le dialogue turc : des prises charabia dans les échanges sur le halva et l'emballage, une paire de lunettes qui disparaît et revient, et des écritures à l'écran sans sens prouvent que le modèle n'a pas encore câblé la parole turque en texte. La leçon du créateur est nette : générer le personnage visuellement d'abord et le passer en référence vaut mieux que de demander la scène directement.
Le final est un montage amusant destiné à ouvrir la vidéo : le gamin messager livrant l'adresse, les scènes de raid et de combat, les variantes de 15 et 30 secondes, l'extension via référence vidéo-à-vidéo et référence audio. Le temps de génération reste proche de 4 minutes, que le clip fasse 15 ou 30 secondes, ce qui fait du prompt par lots le choix le plus sain. Le verdict final est équilibré : réussir des scènes à un million de dollars n'est plus impossible, mais ce n'est pas encore totalement au point ; pour quiconque a une discipline de prompt et un budget d'itération, les résultats impressionnent.
Commentaire de l’IA
""Ce qui m'a convaincu dans cette vidéo, ce ne sont pas les images finales mais le fait que les tentatives ratées n'aient pas été cachées : une fois que vous voyez où le modèle trébuche, vous pouvez planifier vos prompts et votre budget en conséquence. Ma note de carnet : la vidéo IA ne consiste plus à rêver, elle consiste en une discipline d'itération.""
Évaluation de l’IA
Laissez-moi défendre généreusement l'objection la plus forte : ces images ne sont pas du cinéma, ce sont l'image du cinéma. Comme le soulignent les critiques de Seedance de The Verge, le modèle ne saisit toujours pas les détails les plus fins qui rendent une performance humaine vivante ; une sortie qui brille dans le langage de bande-annonce se dissout sur la cohérence narrative longue. Une analyse indépendante abonde : la vidéo IA trouve aujourd'hui sa place dans les bandes-annonces et la prévisualisation, mais ne peut pas porter l'identité et la continuité sur des récits longs métrages. Presque chaque succès de la vidéo est une salve de 5 à 30 secondes ; aucune n'est une scène ininterrompue de deux minutes.
Il y a des fronts que la vidéo ne teste jamais. Ne pas caster délibérément Nicole Kidman est un choix judicieux, puisque les visages ressemblants issus de modèles de classe Seedance ont déjà opposé les studios hollywoodiens à ByteDance, avec des lettres d'objection allant de Disney à Netflix. Le volet des coûts manque aussi : les prix des crédits, le nombre de tentatives ratées et les heures totales passées restent non divulgués, si bien que le récit « en une nuit » rend invisible le coût des sorties jetées.
Le lien dans la description plus la promotion de la remise de 60 pour cent montrent clairement que ce passage comporte un argumentaire de plateforme sponsorisée ; le narrateur ne le cache pas, même si la prétention à surpasser les concurrents ne repose sur aucune mesure indépendante. Je suis prudent sur les chiffres également : le budget du film Chanel est cité au-dessus de 33 millions de dollars dans la vidéo alors que la presse de l'époque écrivait 42 millions ; la ligne de 3,7 millions de dollars pour le cachet de Kidman correspond aux rapports de l'époque de 2 millions de livres. Au moment de décider, je vérifierais ces chiffres auprès de sources d'époque, pas d'une seule vidéo.
Mon verdict : pour la prévisualisation publicitaire, la vidéo courte et le travail sur les réseaux sociaux, ces outils raccourcissent déjà aujourd'hui les calendriers de production ; pour les projets turcs riches en dialogues et les tentatives long métrage, il est encore tôt. Et avec les règles de transparence de l'AI Act européen en vigueur depuis août 2026, tous les maillons de la chaîne publicitaire devront étiqueter les contenus synthétiques ; l'observation selon laquelle les publicités portent la mention deviendra bientôt la norme, pas l'exception.
Sources
10 liens ; 2 d’entre eux sont aussi cités par 2 autres articles. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.
- @youtube https://www.youtube.com/watch?v=almeqlhLLWo
- @seed https://seed.bytedance.com/en/blog/one-take-creation-flexible-referencing-introducing-seedance-2-5
Également cité par : Cloning a Channel With One Prompt: The $33K Video Factory Built on GPT-6 Astra and Higgsfield
- @the-decoder https://the-decoder.com/bytedances-seedance-2-5-breaks-the-30-second-barrier-for-ai-video-generation/
- @prnewswire https://www.prnewswire.com/news-releases/pollo-ai-releases-multi-model-support-offering-all-in-one-video-generation-capabilities-302348811.html
- @businessinsider https://www.businessinsider.com/game-of-thrones-making-battle-of-bastards-2016-6
- @luerzersarchive https://www.luerzersarchive.com/sony-bravia-2005-balls/
- @smh https://www.smh.com.au/entertainment/movies/every-second-counts-in-42m-three-minute-film-20041123-gdk61e.html
- @theverge https://www.theverge.com/ai-artificial-intelligence/883615/seedance-bytedance-tom-cruise-brad-pitt-jia-zhangke
Également cité par : AI Tier List Reset: GPT-6 Astra Takes the Crown as Subscription Math Rewrites the Ranks
- @lewissilkin https://www.lewissilkin.com/insights/2026/07/31/the-new-ai-labelling-rules-for-deployers-in-the-advertising-supply-chain
- @novaknown https://novaknown.com/2026/04/16/ai-video-generation/
intelligence artificielle · seedance 2.5 · pollo ai · génération vidéo · cinéma · publicité