まずは動画をご覧ください。2 分 08 秒のワンカット映像です。
アートジャーニー完全版動画を視聴する(オリジナル X 動画)
続いて、同じスキルで作った、実務により適した動画をご紹介します。SpaceX の 24 年間をまとめたものです。
こうしたホワイトボードアニメーションは、Bilibili や YouTube での長尺解説やチュートリアルに特に向いていると思います。ナレーションに合わせてキャラクターや出来事、関係性を一歩ずつ描き足していくことで、視聴者は視覚的なストーリーに自然についていけます。知識系コンテンツ、製品デモ、コース教材へのアニメーション追加など、ぜひこの方向性を試してみてください。
冒頭の動画では、私のカートゥーンアバターがラスコー洞窟壁画からスタートし、23 種類の異なるアートスタイルを経て、最終的に 2026 年の自分のデスクに戻ってきます。絵の中に入るたびにその画風へと切り替わり、絵の中の要素とインタラクションします。古代エジプト壁画で太陽の球を押すスカラベを飛び越えたり、葛飾北斎の浮世絵で巨大な波の下をくぐったり、モネの太鼓橋で水切りをしたり、ムンクの人物と一緒に叫んだり(帽子が吹き飛びます)、さらには 8 ビットの夜空でコインを弾き出したりもします。
シーンはコードで描かれ、サウンドトラックもサンプル音源を使わずコードで一音ずつ合成されています。Codex の ImageGen で生成した私のアバターを除けば(画像生成のアシスタントとして、今の Codex は本当に「ちょうどいい」レベルになりました)、それ以外はすべて Claude Code 上の Opus 5.5 が手がけました。参考動画を受け取ってからこの最終カットができるまで、1 日もかかっていません。
これらのアニメーションを作る手法を huashu-art-motion というスキルにまとめました。インストールすれば、「ゴッホの『星月夜』風の 15 秒アニメを作って」と直接指示できますし、参考となるショートフィルムを渡して分解・再現させたり、自分のナレーションに沿った解説アニメを作らせたりすることも可能です。
Fable 5.5 から始まった
最近 X で AI 界隈を眺めていたなら、Fable 5.5 で作られたとされる一連のアニメーションを目にしたはずです。ある人はプロンプト 1 つだけで、オリジナル音楽付きの 3 分間のアニメーション短編を手に入れ、6,000 以上のいいねを獲得しました。別の人はスーパーマンがワンカットで次々とアートスタイルを横断していく動画を作り、67 万回再生を記録。そして、猫と人がお茶を飲む 15 秒のアート史アニメーションもありました。背景が洞窟壁画からフラットイラストへと移り変わっていくもので、元々は Tak(@cherry_mx_reds)さんが投稿したものです。

中国語圏の多くの人は、実はこの投稿のリツイート版を見ていました。驚くことに、オリジナルよりもブックマーク数が多かったのです。

現時点で Anthropic は Fable 5.5 を公式リリースしておらず、最新の公式バージョンは 9 月 1 日に公開された Fable 5.1 のままです。これらの作品は、グレースケールテストで Fable 5.5 にルーティングされたと主張するユーザーによるものです(判定方法は「Tibo テスト」と呼ばれる非公式テストで、OpenAI Codex チームの Tibo を知っているかモデルに尋ね、正しく答えられれば知識が更新された新モデルだとみなします)。モデルのバージョン自体は公式に確認されていません。
私もあの動画を Claude Code に読み込ませて再現してみました。ただ、似たものを作った後で私が残したかったのは「成果物」ではなく「方法論」でした。アートスタイルをどう分解するのか、シーン内の要素をどう動かすのか、そしてこのプロセスを今後の別テーマでも再利用するにはどうすればいいのか、ということです。
再現作業の中で興味深い点がありました。元の動画でどの領域が動いているかを特定するために、モーションヒートマップが自動生成されたのです。各時代は約 1 秒しかありませんでしたが、波はうねり、文字は点滅し、常に内部で動きがありました。その後、こうした分解手法もスキルに組み込まれています。

本文中の静止画は完全版サンプル動画に対応しています。上記のリンクから視聴できます。
再現元にはなかった動画
そこで、再現を終えたその夜、元動画にはないテーマを与えてみました。
私のカートゥーンアバターを使って、少なくとも 20 種類の異なるスタイルのシーンを巡らせてください。アバターはシーンに応じて変化し、モネの太鼓橋を通り抜けたり睡蓮の池で水切りをしたりするなど、シーン内の特定のオブジェクトとインタラクションする必要があります。

この動画では、シーンとスタイルはコードで描かれています。私のアバターのアクションフレームは各スタイルごとに gpt-image で描き直され、その後コードによって配置・サイズ・タイミングが調整され、それぞれの画風に応じた筆致がキャラクターに重ねられます。

サウンドトラックもアートスタイルに連動しています。洞窟パートは骨笛と手太鼓、敦煌は琵琶、浮世絵は三味線と尺八、8 ビットは矩形波です。すべての音はコードで合成され、シーンが切り替わるたびに楽器と旋法が変わります。

実務シーンで試してみる
とはいえ、モデルの能力やそれを引き出す自分の腕前を披露すること以上に、私が気にしているのは「これを実務で使えるか」です。
そこで、YouTube でよく見られる 8 つの解説スタイルを追加しました。Whiteboard、Vox、Kurzgesagt、3Blue1Brown、Keynote UI、Financial Charts、Storytelling、Dynamic Text です。データなら Financial Charts、数学や AI の概念なら 3b1b、ソフトチュートリアルの画面操作なら Keynote UI と、解説する内容に応じてスタイルを選べます。
冒頭のホワイトボード版に加え、同じく SpaceX の 24 年間を扱った Vox スタイル版がこちらです。
同じテーマでも表現を変えると、受ける印象は大きく変わります。ナレーション原稿を渡して尺に合わせたアニメーションパートを生成し、編集中の動画に差し込むこともできますし、この 2 つの例のように、解説全体をそのままアニメーション化することもできます。
私自身、この用途は今後かなり頻繁に使うことになるでしょう。Bilibili や YouTube 向けの長尺動画を作っていて、言葉だけでは説明しにくいポイントに出会ったとき、ナレーションに合わせて図解がステップバイステップで展開される専用パートを差し込めるからです。
このスキルの中身
前述の 8 つの解説スタイルに加え、数十枚のアートスタイルカードが含まれています。洞窟壁画、古代エジプト、浮世絵、印象派から、ゴッホ、ムンク、ダリ、ホッパー、ポップアート、スタジオジブリ、新海誠、ヴェイパーウェイヴまで網羅しています。各カードにはカラーパレット、筆致の技法、アニメーション手法、そして現時点での制約が記されており、次回以降の改善につなげられます。

参考動画の分解方法、キャラクターフレームの生成と合成、サウンドトラックと映像の同期手順も含まれています。完成後はプログラムが静止フレームや不自然なジャンプといった問題をチェックし、さらに独立したエージェントが最終カットを確認して粗を探します。
私は常に、実践でうまくいったことを記録させるようにしています。手法、根拠、理由、そしてどんな場面で適用すべきかを含めます。次にテーマやスタイル、あるいはモデルを変えても、これらの経験値は引き継がれます。
このスキルを入手する
スキルは GitHub でオープンソース化しています。
https://github.com/alchaincyf/huashu-art-motion
インストール方法(Claude Code、Codex、Cursor など、スキルに対応した任意のエージェントで動作します):
npx skills add alchaincyf/huashu-art-motion
動画のレンダリングにはローカル環境に uv と ffmpeg が必要です。初回レンダリング前にヘッドレスブラウザをインストールしてください:uv run --with playwright install chromium





