Primeiro, assista ao vídeo. É um plano-sequência de 2 minutos e 08 segundos.
Assista ao vídeo completo da jornada artística (Vídeo original no X)
Em seguida, aqui está um vídeo mais adequado para o trabalho real, também feito com essa técnica, cobrindo os 24 anos da SpaceX.
Assista à versão completa do vídeo no estilo quadro branco sobre a SpaceX
Acredito que esse tipo de animação em quadro branco é especialmente indicado para explicações longas e tutoriais no Bilibili e no YouTube: desenhar personagens, eventos e relações passo a passo junto com a narração permite que o público acompanhe a narrativa visual. Você pode explorar esse caminho para divulgação científica, demonstrações de produtos ou para adicionar animações aos seus cursos.
O vídeo de abertura mostra meu avatar em desenho animado começando nas pinturas rupestres de Lascaux, passando por 23 estilos artísticos diferentes e, finalmente, voltando à minha mesa em 2026. Cada vez que entro em uma pintura, mudo para o estilo daquela obra e interajo com os elementos dentro dela: pulando sobre o escaravelho que empurra o disco solar nos murais do antigo Egito, abaixando para passar sob a onda gigante na gravura de Hokusai, fazendo pedras quicarem na ponte japonesa de Monet, gritando ao lado da figura de Munch (meu chapéu voa longe) e até fazendo uma moeda saltar num céu noturno em 8 bits.
As cenas são desenhadas por código, e a trilha sonora é sintetizada nota por nota por código (sem uso de samples). Com exceção do meu avatar, gerado pelo ImageGen do Codex (o Codex hoje é realmente bom o suficiente apenas como assistente para geração de imagens), todo o resto foi feito pelo Opus 5.5 no Claude Code. Do momento em que recebi o vídeo de referência até esta versão final, levou menos de um dia.
Condensei o método para criar essas animações em uma skill chamada huashu-art-motion. Depois de instalada, você pode simplesmente dizer: "Faça uma animação de 15 segundos no estilo 'Noite Estrelada' de Van Gogh", ou entregar um curta-metragem de referência para ela desconstruir, replicar ou criar animações explicativas baseadas na sua narração.
Começando com o Fable 5.5
Se você tem acompanhado a comunidade de IA no X recentemente, provavelmente viu uma leva de animações supostamente feitas pelo Fable 5.5. Uma pessoa usou apenas um prompt e recebeu de volta um curta de animação de 3 minutos com música original, acumulando mais de 6.000 curtidas; outra fez o Superman atravessar continuamente diferentes estilos artísticos em um único plano, chegando a 670.000 visualizações; e houve ainda uma animação de 15 segundos sobre história da arte com um gato e uma pessoa tomando chá, cujos cenários mudavam de pinturas rupestres para ilustrações flat, publicada originalmente por Tak (@cherry_mx_reds).

Muitas pessoas na comunidade de língua chinesa viram, na verdade, um retuíte dessa publicação, que surpreendentemente teve mais salvamentos do que o post original.

Até hoje, a Anthropic não lançou oficialmente o Fable 5.5; a versão oficial mais recente continua sendo o Fable 5.1, lançado em 1º de setembro. Esses trabalhos vêm de usuários que afirmam ter sido direcionados ao Fable 5.5 por meio de testes em escala cinza (o método de verificação é um teste informal chamado "teste Tibo": perguntar ao modelo se ele conhece o Tibo, da equipe OpenAI Codex; se responder corretamente, considera-se que é um novo modelo com conhecimento atualizado). A versão do modelo em si não foi confirmada oficialmente.
Eu também inseri aquele vídeo no Claude Code para replicá-lo. No entanto, depois de produzir algo semelhante, o que eu quis preservar mesmo foi o método: como desconstruir estilos artísticos, fazer os elementos da cena se moverem e reutilizar esse processo em temas futuros.
Durante a replicação, surgiu um detalhe interessante: o sistema gerou automaticamente um mapa de calor de movimento para identificar quais áreas estavam em ação no vídeo original. Embora cada época durasse apenas cerca de 1 segundo, as ondas se moviam, textos piscavam e havia movimento interno constante. Mais tarde, esses métodos de desconstrução foram incluídos na skill.

Os frames estáticos no texto correspondem aos vídeos completos de amostra, que podem ser assistidos pelos links originais acima.
O Vídeo Que Não Estava na Replicação
Então, na noite seguinte à conclusão da replicação, dei a ele um tema que não existia no original:
Use meu avatar em desenho animado para viajar por pelo menos 20 cenários de estilos diferentes. O avatar deve mudar conforme a cena e interagir com objetos específicos dentro delas, como atravessar a ponte japonesa de Monet e fazer pedras quicarem no lago de nenúfares.

Neste vídeo, as cenas e os estilos são desenhados por código. Os frames de ação do meu avatar para cada estilo são redesenhados usando gpt-image e, em seguida, posicionados, dimensionados e temporizados por código, sobrepondo pinceladas correspondentes a cada estilo artístico no personagem.

A trilha sonora também acompanha o estilo artístico: flautas de osso e tambores manuais para o segmento das cavernas, pipa para Dunhuang, shamisen e shakuhachi para Ukiyo-e, e ondas quadradas para 8 bits. Todos os sons são sintetizados por código, trocando instrumentos e modos ao mudar de cena.

Testando em Cenários Reais de Trabalho
Porém, além de demonstrar as capacidades do modelo ou a minha habilidade de explorá-las, o que mais me importa é saber se isso pode ser aplicado em situações reais de trabalho.
Por isso, adicionamos 8 estilos de explicação comuns no YouTube, incluindo Whiteboard, Vox, Kurzgesagt, 3Blue1Brown, Keynote UI, Financial Charts, Storytelling e Dynamic Text. Use Financial Charts para dados, experimente o 3b1b para conceitos de matemática e IA, use Keynote UI para operações de interface em tutoriais de software e escolha o estilo de acordo com o conteúdo explicado.
Além do quadro branco da abertura, aqui está o estilo Vox, também cobrindo os 24 anos da SpaceX:
Assista à versão completa do vídeo no estilo Vox sobre a SpaceX
Mudar a forma de expressão para o mesmo tema cria uma sensação visual completamente diferente. Você pode entregar seu roteiro de narração, gerar segmentos de animação correspondentes por duração e inseri-los nos vídeos que estiver editando; ou, como nestes dois exemplos, transformar uma explicação completa em uma animação.
Para mim, essa parte será usada com muito mais frequência. Quando estou produzindo um vídeo longo para o Bilibili ou YouTube e me deparo com um ponto difícil de explicar só com palavras, posso adicionar um segmento separado onde os gráficos se desenvolvem passo a passo junto com a narração.
O Que Tem Dentro Dessa Skill
Além dos 8 estilos de explicação mencionados acima, ela inclui dezenas de cards de estilos artísticos, indo de pinturas rupestres, antigo Egito, Ukiyo-e e Impressionismo até Van Gogh, Munch, Dalí, Hopper, Pop Art, Studio Ghibli, Makoto Shinkai e Vaporwave. Cada card contém paletas de cores, técnicas de pincelada, métodos de animação e limitações atuais, permitindo melhorias iterativas na próxima vez.

Também estão inclusos métodos para desconstruir vídeos de referência, gerar e compor frames de personagens e sincronizar trilhas sonoras com as imagens. Após a conclusão, um programa verifica problemas como frames estáticos ou saltos anormais, seguido por um agente independente que revisa a edição final para encontrar falhas.
Sempre exijo que ele registre o que funcionou bem na prática, incluindo métodos, evidências, motivos e quando aplicá-los. Na próxima vez que você mudar de tema, estilo ou até de modelo, essas experiências são levadas adiante.
Como Obter Esta Skill
A skill é open-source no GitHub:
https://github.com/alchaincyf/huashu-art-motion
Instalação (funciona com qualquer agente que suporte skills, como Claude Code, Codex, Cursor):
npx skills add alchaincyf/huashu-art-motion
Renderizar vídeos exige uv e ffmpeg na sua máquina local. Instale o navegador headless antes da primeira renderização: uv run --with playwright install chromium.





