Primeiro, assista ao vídeo. É um plano-sequência de 2 minutos e 08 segundos.
Assista ao vídeo completo da jornada artística (Vídeo original no X)
Em seguida, aqui está um vídeo mais adequado para o trabalho real, também feito com essa técnica, cobrindo os 24 anos da SpaceX.
Assista à versão completa em quadro branco sobre a SpaceX
Acredito que esse tipo de animação em quadro branco seja especialmente indicado para explicações longas e tutoriais no Bilibili e no YouTube: desenhar personagens, eventos e relações passo a passo junto com a narração permite que o espectador acompanhe a narrativa visual. Você pode explorar essa abordagem para divulgação científica, demonstrações de produtos ou para adicionar animações aos seus cursos.
O vídeo de abertura mostra meu avatar em desenho animado começando nas pinturas rupestres de Lascaux, passando por 23 estilos artísticos diferentes e, finalmente, voltando à minha mesa em 2026. Cada vez que entro em uma pintura, mudo para o estilo daquela obra e interajo com os elementos dentro dela: pulo sobre o escaravelho que empurra o disco solar nos murais do antigo Egito, me abaixo sob a onda gigante na xilogravura de Hokusai, faço pedras quicarem na ponte japonesa de Monet, grito ao lado da figura de Munch (meu chapéu voa longe) e até faço uma moeda saltar num céu noturno em 8 bits.
As cenas são desenhadas por código, e a trilha sonora é sintetizada nota por nota por código (sem uso de samples). Exceto pelo meu avatar, gerado com o ImageGen do Codex (o Codex hoje é realmente bom o suficiente apenas como assistente para geração de imagens), todo o resto foi feito pelo Opus 5.5 no Claude Code. Desde o recebimento do vídeo de referência até esta montagem final, levou menos de um dia.
Condensei o método para criar essas animações em uma skill chamada huashu-art-motion. Depois de instalada, você pode simplesmente dizer: "Faça uma animação de 15 segundos no estilo 'Noite Estrelada' de Van Gogh", ou entregar um curta-metragem de referência para ela desconstruir, replicar ou criar animações explicativas baseadas na sua narração.
Começando com o Fable 5.5
Se você tem acompanhado a comunidade de IA no X recentemente, provavelmente viu uma leva de animações supostamente feitas pelo Fable 5.5. Uma pessoa usou apenas um prompt e recebeu de volta um curta de animação de 3 minutos com música original, acumulando mais de 6.000 curtidas; outra fez o Superman atravessar continuamente diferentes estilos artísticos em um único plano, alcançando 670.000 visualizações; e houve ainda uma animação de 15 segundos sobre história da arte com um gato e uma pessoa tomando chá, cujos cenários mudavam de pinturas rupestres para ilustrações flat, postada originalmente por Tak (@cherry_mx_reds).

Muitas pessoas na comunidade lusófona e chinesa, na verdade, viram um retuíte dessa publicação, que surpreendentemente teve mais salvamentos do que o post original.

Até hoje, a Anthropic não lançou oficialmente o Fable 5.5; a versão oficial mais recente continua sendo o Fable 5.1, lançado em 1º de setembro. Esses trabalhos vêm de usuários que afirmam ter sido direcionados ao Fable 5.5 por meio de testes em escala cinza (o método de verificação é um teste informal chamado teste Tibo: perguntar ao modelo se ele conhece o Tibo da equipe OpenAI Codex; se responder corretamente, considera-se que é um novo modelo com conhecimento atualizado). A versão do modelo em si não foi confirmada oficialmente.
Eu também inseri aquele vídeo no Claude Code para replicá-lo. No entanto, depois de produzir algo semelhante, o que eu quis preservar mesmo foi o método: como desconstruir estilos artísticos, fazer os elementos da cena se moverem e reutilizar esse processo em temas futuros.
Durante a replicação, houve um detalhe interessante: o sistema gerou automaticamente um mapa de calor de movimento para identificar quais áreas estavam em ação no vídeo original. Embora cada era durasse apenas cerca de 1 segundo, as ondas se moviam, textos piscavam e havia movimento interno constante. Mais tarde, esses métodos de desconstrução foram incluídos na skill.

Os quadros estáticos no texto correspondem aos vídeos completos de amostra, que podem ser assistidos pelos links originais acima.
O Vídeo Que Não Estava na Replicação
Então, na noite seguinte à conclusão da replicação, dei a ele um tema que não existia no original:
Use meu avatar em desenho animado para viajar por pelo menos 20 cenários de estilos diferentes. O avatar deve mudar conforme a cena e interagir com objetos específicos dentro dela, como passar pela ponte japonesa de Monet e fazer pedras quicarem no lago de nenúfares.

Neste vídeo, as cenas e os estilos são desenhados por código. Os quadros de ação do meu avatar para cada estilo são redesenhados usando o gpt-image e, em seguida, posicionados, dimensionados e temporizados por código, sobrepondo pinceladas correspondentes a cada estilo artístico no personagem.

A trilha sonora também segue o estilo artístico: flautas de osso e tambores manuais para o segmento das cavernas, pipa para Dunhuang, shamisen e shakuhachi para o Ukiyo-e e ondas quadradas para o 8-bit. Todos os sons são sintetizados por código, trocando instrumentos e modos ao mudar de cena.

Testando em Cenários Reais de Trabalho
Porém, além de demonstrar as capacidades do modelo ou a minha habilidade de aproveitá-las, o que mais me importa é saber se isso pode ser aplicado em cenários reais de trabalho.
Por isso, adicionamos 8 estilos de explicação comuns no YouTube, incluindo Whiteboard, Vox, Kurzgesagt, 3Blue1Brown, Keynote UI, Gráficos Financeiros, Storytelling e Texto Dinâmico. Use Gráficos Financeiros para dados, experimente o 3b1b para matemática e conceitos de IA, use o Keynote UI para operações de interface em tutoriais de software e escolha o estilo de acordo com o conteúdo explicado.
Além do quadro branco da abertura, aqui está o estilo Vox, também cobrindo os 24 anos da SpaceX:
Assista à versão completa estilo Vox sobre a SpaceX
Mudar a forma de expressão para o mesmo tema cria uma sensação visual completamente diferente. Você pode entregar seu roteiro de narração, gerar segmentos de animação correspondentes por duração e inseri-los nos vídeos que estiver editando; ou, como nestes dois exemplos, transformar uma explicação completa em uma animação.
Para mim, essa parte será usada com muito mais frequência. Ao fazer um vídeo longo para o Bilibili ou YouTube e me deparar com um ponto difícil de explicar apenas verbalmente, posso adicionar um segmento separado onde os gráficos se desenvolvem passo a passo junto com a narração.
O Que Tem Dentro Dessa Skill
Além dos 8 estilos de explicação mencionados acima, ela inclui dezenas de cartões de estilos artísticos, desde pinturas rupestres, antigo Egito, Ukiyo-e e Impressionismo até Van Gogh, Munch, Dalí, Hopper, Pop Art, Studio Ghibli, Makoto Shinkai e Vaporwave. Cada cartão contém paletas de cores, técnicas de pincelada, métodos de animação e limitações atuais, permitindo melhorias iterativas na próxima vez.

Métodos para desconstruir vídeos de referência, gerar e compor quadros de personagens e sincronizar trilhas sonoras com as imagens também estão incluídos. Após a conclusão, um programa verifica problemas como quadros estáticos ou saltos anormais, seguido por um agente independente que revisa a montagem final para encontrar falhas.
Sempre exijo que ele registre o que foi feito corretamente na prática, incluindo métodos, evidências, motivos e quando aplicá-los. Na próxima vez que você mudar de tema, estilo ou até de modelo, essas experiências serão mantidas.
Como Obter Esta Skill
A skill é de código aberto no GitHub:
https://github.com/alchaincyf/huashu-art-motion
Instalação (funciona com qualquer agente que suporte skills, como Claude Code, Codex, Cursor):
npx skills add alchaincyf/huashu-art-motion
Renderizar vídeos exige uv e ffmpeg na sua máquina local. Instale o navegador headless antes da primeira renderização: uv run --with playwright install chromium.





