D'abord, regardez la vidéo. C'est un plan-séquence de 2 minutes et 8 secondes.
Regarder la vidéo complète du parcours artistique (vidéo X originale)
Ensuite, voici une vidéo plus adaptée à un usage professionnel, également réalisée avec cette technique, qui retrace les 24 ans de SpaceX.
Regarder la version complète tableau blanc sur SpaceX
Je trouve que ce type d'animation tableau blanc se prête particulièrement bien aux explications longues et aux tutoriels sur Bilibili et YouTube : dessiner pas à pas les personnages, les événements et leurs relations en suivant la voix off permet aux spectateurs de suivre le fil visuel sans effort. Vous pouvez explorer cette piste pour la vulgarisation, les démos produits ou l'ajout d'animations dans vos formations.
La vidéo d'ouverture met en scène mon avatar cartoon qui part des peintures rupestres de Lascaux, traverse 23 styles artistiques différents, pour finalement revenir à mon bureau en 2026. À chaque fois que j'entre dans un tableau, j'adopte son style et j'interagis avec ses éléments : je saute par-dessus le scarabée poussant le disque solaire dans les fresques égyptiennes, je me baisse sous la vague géante de l'estampe d'Hokusai, je fais des ricochets sur le pont japonais de Monet, je hurle aux côtés du personnage de Munch (mon chapeau s'envole), et je fais même apparaître une pièce de monnaie dans un ciel nocturne en 8-bit.
Les scènes sont dessinées par du code, et la bande-son est synthétisée note par note par du code (aucun sample utilisé). À l'exception de mon avatar, généré via ImageGen de Codex (Codex est aujourd'hui tout juste assez bon comme assistant pour la génération d'images), tout le reste a été réalisé par Opus 5.5 dans Claude Code. Entre la réception de la vidéo de référence et ce montage final, il s'est écoulé moins d'une journée.
J'ai condensé la méthode de création de ces animations dans une skill nommée huashu-art-motion. Une fois installée, vous pouvez simplement lui dire : « Fais-moi une animation de 15 secondes dans le style de La Nuit étoilée de Van Gogh », ou lui fournir un court-métrage de référence à déconstruire, à reproduire, ou encore créer des animations explicatives calées sur votre voix off.
Tout a commencé avec Fable 5.5
Si vous avez scrollé la sphère IA sur X récemment, vous avez sûrement vu passer une série d'animations prétendument créées par Fable 5.5. Quelqu'un a tapé un seul prompt et obtenu un court-métrage animé de 3 minutes avec musique originale, récoltant plus de 6 000 likes ; un autre a fait traverser continuellement différents styles artistiques à Superman en un seul plan, atteignant 670 000 vues ; et il y a eu cette animation de 15 secondes sur l'histoire de l'art montrant un chat et une personne buvant du thé, avec des décors passant des peintures rupestres aux illustrations flat design, publiée à l'origine par Tak (@cherry_mx_reds).

Beaucoup de gens dans la communauté francophone ont en réalité découvert un retweet de ce post, qui avait d'ailleurs, chose surprenante, plus de signets que l'original.

À ce jour, Anthropic n'a pas officiellement sorti Fable 5.5 ; la dernière version officielle reste Fable 5.1, publiée le 1er septembre. Ces œuvres proviennent d'utilisateurs affirmant avoir été basculés sur Fable 5.5 via un déploiement progressif (la méthode de vérification repose sur un test empirique appelé le test Tibo : on demande au modèle s'il connaît Tibo de l'équipe OpenAI Codex ; s'il répond correctement, on considère qu'il s'agit d'un nouveau modèle aux connaissances actualisées). La version du modèle elle-même n'a pas été confirmée officiellement.
J'ai moi aussi injecté cette vidéo dans Claude Code pour la reproduire. Mais après avoir créé une œuvre similaire, ce que je voulais surtout conserver, c'était la méthode : comment déconstruire des styles artistiques, animer les éléments d'une scène et réutiliser ce processus pour de futurs sujets.
Pendant la reproduction, un détail intéressant est apparu : le système a automatiquement généré une carte thermique de mouvement pour identifier quelles zones bougeaient dans la vidéo originale. Même si chaque époque ne durait qu'environ 1 seconde, les vagues roulaient, le texte clignotait, et il y avait un mouvement interne constant. Par la suite, ces méthodes de déconstruction ont été intégrées à la skill.

Les images fixes présentées dans le texte correspondent aux vidéos d'exemple complètes, que vous pouvez visionner via les liens originaux ci-dessus.
La vidéo qui n'était pas dans la reproduction
Alors, le soir même après avoir terminé la reproduction, je lui ai soumis un sujet absent de l'original :
Utilise mon avatar cartoon pour voyager à travers au moins 20 scénarios de styles différents. L'avatar doit évoluer avec la scène et interagir avec des objets précis à l'intérieur, comme traverser le pont japonais de Monet et faire des ricochets dans le bassin aux nymphéas.

Dans cette vidéo, les scènes et les styles sont dessinés par du code. Les images clés de mon avatar pour chaque style sont redessinées avec gpt-image, puis positionnées, dimensionnées et synchronisées par du code, superposant ainsi des coups de pinceau correspondant à chaque courant artistique sur le personnage.

La bande-son suit également le style artistique : flûtes en os et tambours à main pour la séquence préhistorique, pipa pour Dunhuang, shamisen et shakuhachi pour l'Ukiyo-e, et ondes carrées pour le 8-bit. Tous les sons sont synthétisés par du code, changeant d'instruments et de modes lors des transitions de scènes.

Le test en conditions réelles
Cependant, au-delà de la démonstration des capacités du modèle ou de ma capacité à les exploiter, ce qui m'importe vraiment, c'est de savoir si cela peut s'appliquer à de vrais cas d'usage professionnels.
Nous avons donc ajouté 8 styles d'explication courants sur YouTube, dont Whiteboard, Vox, Kurzgesagt, 3Blue1Brown, Keynote UI, Financial Charts, Storytelling et Dynamic Text. Utilisez Financial Charts pour les données, essayez 3b1b pour les concepts mathématiques et liés à l'IA, optez pour Keynote UI pour les manipulations d'interface dans les tutoriels logiciels, et choisissez le style en fonction du contenu expliqué.
Outre le tableau blanc de l'ouverture, voici le style Vox, couvrant lui aussi les 24 ans de SpaceX :
Regarder la version complète style Vox sur SpaceX
Changer de registre visuel pour un même sujet crée un rendu radicalement différent. Vous pouvez fournir votre script de voix off, générer les segments d'animation correspondants selon leur durée, et les insérer dans vos montages vidéo ; ou bien, comme dans ces deux exemples, transformer une explication complète en animation.
Personnellement, c'est cette partie que j'utiliserai le plus souvent. Quand je réalise une longue vidéo pour Bilibili ou YouTube et que je bute sur un point difficile à expliquer à l'oral, je peux ajouter un segment dédié où les graphiques se déploient pas à pas en suivant la narration.
Ce que contient cette Skill
Outre les 8 styles d'explication mentionnés plus haut, elle inclut des dizaines de fiches de styles artistiques, allant des peintures rupestres, de l'Égypte antique, de l'Ukiyo-e et de l'impressionnisme, jusqu'à Van Gogh, Munch, Dalí, Hopper, le Pop Art, le Studio Ghibli, Makoto Shinkai et le Vaporwave. Chaque fiche contient des palettes de couleurs, des techniques de coups de pinceau, des méthodes d'animation et les limites actuelles, permettant des améliorations itératives par la suite.

Les méthodes pour déconstruire les vidéos de référence, générer et composer les images de personnages, ainsi que synchroniser la bande-son au visuel sont également incluses. Une fois terminé, un programme vérifie l'absence de problèmes comme des images figées ou des sauts anormaux, suivi d'un agent indépendant qui examine le montage final pour traquer les défauts.
J'exige toujours qu'il consigne ce qui a bien fonctionné en pratique, y compris les méthodes, les preuves, les raisons et le moment opportun pour les appliquer. Ainsi, la prochaine fois que vous changerez de sujet, de style ou même de modèle, cette expérience sera conservée.
Obtenir cette Skill
La skill est open-source sur GitHub :
https://github.com/alchaincyf/huashu-art-motion
Installation (fonctionne avec tout agent prenant en charge les skills, comme Claude Code, Codex, Cursor) :
npx skills add alchaincyf/huashu-art-motion
Le rendu des vidéos nécessite uv et ffmpeg sur votre machine locale. Installez le navigateur headless avant le premier rendu : uv run --with playwright install chromium.





