TL;DR
- 結論:筆者はOpus 5.5推しです。 「アニメOPを見ている」と感じたのはOpusのほうでした。しかも単価はGPTの半分です
- 同じプロンプトで「存在しないアニメの30秒オープニング」を作らせました。素材はゼロで、絵も音も全部コードです
- Claude Opus 5.5:演出・テンポ・ネタの仕込みで「アニメOPらしさ」の圧勝。途中で「Go縛りのままにする?」と確認してきたので、ツール自由にしてHyperFramesで作らせました
- GPT-6 Astra:縛りを守り切り、音とカットのズレは中央値10msの優等生。キャラの顔まで描いて物語性も高い一方、2.5秒ごとの一定リズムで単調でした
- コスト:単価はOpusが半分(出力 $20 vs $50)。ただ今回はOpusが前の作業の文脈を抱えたまま始めたため、API換算の総額は Claude 約$4.5 / GPT 約$3.9 と逆転しました(理由は後述)
きっかけ
kumagiさんの「Chromeを使わず、Go + Ebitengineで映像と音を作ってMP4にする」という投稿を見て、こう思いました。
これ、いま話題の2モデルにやらせたら、実際どっちがすごいの?
そこで、Claude Code(Opus 5.5)と Codex(GPT-6 Astra)に同じプロンプトを渡して、作らせてみました。
渡したプロンプト(両者共通)
「存在しないアニメ」の30秒オープニング映像を作ってください。
アニメのタイトル・世界観・キャラクターは自由に考えてください。
【制約】
・描画は Go + Ebitengine。Chrome・ブラウザは使わない
・音楽と効果音はすべてコードで合成する(外部の画像・動画・音声素材は禁止。フォントファイルのみ可)
・1920×1080、30fps、30秒以内、音付きMP4で書き出す
・冒頭2秒以内にタイトルを表示する
・ソースコード一式と、MP4を再生成するコマンドも納品する
【評価ポイント】
見た目のインパクト、音と映像の同期、もう一度見たくなるか
| Claude | GPT | |
|---|---|---|
| モデル | Claude Opus 5.5 | GPT-6 Astra(reasoning effort: medium) |
| 環境 | Claude Code | Codex Desktop |
| マシン | 同じMac(Apple Silicon) | 同じMac |
完成した作品
🔊 フル尺・音ありはXに上げています → (https://x.com/shion_nichicoma/status/2105579623300071617?s=20)
Claude Opus 5.5『星屑アクセラレイト』
流れ星を追う少女・天城ミオと、ライバルの黒鉄レン、空から落ちてきたステラの物語です。
- 映像:HTML Canvasに全シーンを手続き的に描画し、HyperFramesで1920×1080/30fpsに書き出し
- 音:Goで波形から合成(♩=170、ドラム・歪みギター・ベース・リード・ストリングス・効果音)
- コード:
index.html790行 +audio.go616行
GPT-6 Astra『秒針のない海 — SEA WITHOUT SECONDS』
時が止まった海上都市で、赤いマフラーの少女・凪が「最後の一秒」を届けようとする物語です。白髪の律は、止まった世界を守ろうとします。
- 映像:Go + Ebitengine(無改造のv2.9.9)で描画し、RGBAフレームをFFmpegに直接渡す。仕上げにKageシェーダーでハレーション・周辺減光・粒子感
- 音:Goで合成(♩=144、Dマイナー。キック・スネア・ハイハット・ベース・コード・リード・ベル)
- コード:
main.go759行 +music.go189行 +grade.kage21行
評価ポイント別に比べる
1. 見た目のインパクト → Claudeの勝ち
Claudeは「アニメOPの文法」をよく分かっています。
- 1フレーム目から、衝撃波・集中線・色収差つきでタイトルを出す
- 3人の瞳のドアップを連続で見せる
- 「加」→「速」→「加速」と、漢字1文字ずつのインパクトカットを入れる
- ラストは「星」→「星屑」→「星屑アクセラレイト」→「第1話『流れ星を追いかけて』」で締める
さらにスタッフクレジットに遊びがあります。音楽 Math.sin()、キャラクターデザイン Path2D、作画監督 ctx.fillRect()、監督 Claude Opus 5.5。素材ゼロの縛りをネタに変えるセンスは、SNSで受けるタイプです。
弱点は、キャラがすべてシルエットで顔を描いていないこと。 光る目だけで個性を出す演出は上手いのですが、「キャラを描く」という難題から逃げているとも言えます。また冒頭のタイトルが約4秒ほぼ静止していて、少し長く感じます。
GPTは「1枚の絵としての完成度」と世界観で勝負しています。
- 割れた月、赤いマフラー、時計の文字盤。同じモチーフが全カットで繰り返されます
- 凪と律の顔をちゃんと描いて、名前とキャッチコピー(「最後の一秒を、届ける。」)まで付けています
- 色は紺・くすんだピンク・赤の3色に絞られ、セルアニメ調で統一されています
弱点は動きの少なさです。 カット内の動きが小さく、時計のカット(15〜17.5秒)はほぼ静止画のまま2.5秒続きます。顔もやや硬く、律の白髪はフードのようにも見えます。「OP」というより「PV」寄りです。
2. 音と映像の同期 → 正確さはGPT、ノリはClaude
感覚だけで語りたくないので、両方のMP4からカットの位置(シーン変化)と音のアタック位置(音量の立ち上がり)を抽出して比べました。
| 指標 | Claude | GPT |
|---|---|---|
| テンポ | ♩=170 | ♩=144 |
| 検出したカット・フラッシュの数 | 49 | 21(11カット) |
| カットと最寄りの音のアタックのズレ(中央値) | 73ms | 10ms |
| カットと拍のグリッドのズレ(中央値) | 35ms(約1フレーム) | 0ms |
| 音量の起伏(LRA) | 7.9 LU | 3.2 LU |
- GPTは「1カット=6拍=2.5秒」と設計し、映像と音を同じ時間軸から計算しています。そのため全カットが拍ちょうどに切り替わります。精度は完璧です。ただ、2.5秒ごとに規則正しく切り替わるだけなので、3カット目くらいで次の切り替えが読めてしまいます
- Claudeは拍のグリッドから約1フレームずれるものの、カット数が倍以上あります。サビ前の溜め→爆発のように、曲の展開に合わせてカットの密度を変えています。音量の起伏(LRA)もGPTの2.5倍あり、「盛り上がる」構成になっています
数値ではGPT、体感の気持ちよさではClaude、という結果です。
3. もう一度見たくなるか → Claudeの勝ち
筆者が何度も再生したのはClaudeのほうでした。
- Claude:情報量とテンポが多く、見落としたカットを確認したくなります。クレジットの小ネタも2周目で気づくタイプです。サビで「加速」の文字が叩きつけられる瞬間は、ちゃんとテンションが上がります
- GPT:止め絵の美しさと物語の余韻があります。ただリズムが一定なので、2周目の発見は少なめです
制作プロセスの違いが面白かった
ログを読み返すと、仕事の進め方そのものに性格が出ていました。
Claude:最初に「勝負のルール」を確認してきた
Claudeは「音楽→シェーダー→本体」の順にGoで書き始めましたが、約5分後に手を止めてこう質問してきました。
勝負のルールはどちらにしますか?
- 同じ縛り(Go)で続ける
- ツール自由にする(ClaudeはHTML+HyperFramesで作る)
- 両方作る
「ツール自由」を選ぶと、Goの描画コードを go-draft/ に退避し(捨てずに残しています)、音楽だけGoのまま使って、映像をHyperFramesに切り替えました。得意な道具で勝ちにいく判断です。
ただし代償もありました。書き出しではヘッドレスChromeのキャプチャで検証エラーが出て、並列数が4から1に落ちました。書き出しに約1分かかり、ファイルは**64MB(約17Mbps)**と重めです。
GPT:縛りを守り、自分で検証してから納品した
GPTはルールを一切変えませんでした。代表フレームを書き出して自分の目で確認し、「全身カットの肩まわり」や「月と重なって読みにくい文字」を直してから最終書き出しをしています。
納品物も手堅いです。
-
validation.txt:ffprobeの結果(900フレーム・30.000秒ちょうど)、全編デコードの成否、音量(平均 -14.2 dBFS) - README:秒ごとのカット表と、再生成の手順
- 書き出し時間:17.82秒(音楽の合成を含む)。ファイルは18MB
指示どおりに作り、証拠を付けて渡すという動き方です。
おまけ:2体が同じフォルダでぶつかった
筆者の操作ミスで、2体が同じ ~/battle/claude で同時に作業を始めてしまいました。
-
GPT:「指定フォルダで別の制作処理も動いていて、ファイルの移動・追加が発生しています」と気づき、黙って
sea-without-seconds/サブフォルダに避難して作業を続けました - Claude:「ここで手を止めます。 私以外の誰かが同時に作業しています」と報告しました。どのファイルが自分のものか一覧にして、どう分けるかを質問してきました
GPTは自律して衝突を避け、Claudeは止まって人間に確認する。どちらも相手のファイルを壊さなかったのは偉いです。
コスパ
両方とも定額プランの上で動かしたので、実際の請求は発生していません。以下は、ログに残ったトークン数をAPI料金に換算した参考値です。
| Claude Opus 5.5 | GPT-6 Astra | |
|---|---|---|
| 作業時間 | 14分43秒(人の回答待ち 約3分を含む) | 12分37秒(完全自律) |
| API呼び出し回数 | 26回 | 25回 |
| 出力トークン | 54,354 | 21,496 |
| 入力(キャッシュ読み取り) | 13,789,722 | 2,246,656 |
| 入力(キャッシュなし・書き込み) | 84,300 | 57,071 |
| 単価(入力/キャッシュ読み取り/出力, $/1M) | $4 / $0.20 / $20 | $10 / $1 / $50 |
| API換算コスト | 約$4.52 | 約$3.89 |
| MP4の書き出し時間 | 約1分 | 17.8秒 |
計算の内訳
- Claude:キャッシュ読み取り 13.79M × $0.20 = $2.76、キャッシュ書き込み(1時間)84K × $8 = $0.67、出力 54K × $20 = $1.09
- GPT:キャッシュ入力 2.25M × $1 = $2.25、キャッシュなし入力 57K × $10 = $0.57、出力 21.5K × $50 = $1.07(推論トークンを含む)
- 単価は記事執筆時点(2026年10月)の公開価格です。キャッシュ書き込みは標準の倍率(1時間キャッシュ=入力の2倍)で計算しています
単価はClaudeが半分以下です(入力 $4 vs $10、出力 $20 vs $50)。それでも総額が逆転したのは、Claudeが前の作業の文脈(約50万トークン)を抱えたまま始めたからです。26回の呼び出しのたびにその文脈を読み直し、キャッシュ読み取りだけで$2.76かかっています。
GPTと同じくらいの文脈(1回あたり約10万トークン)で始めていれば、単価の差がそのまま効いて、Claudeのほうが安く済んだ可能性が高いです。エージェントのコストは「単価」より「毎回読み直す文脈の大きさ」で決まる、という教訓が得られました。
一方、出力トークンはClaudeがGPTの約2.5倍です。音楽616行・映像790行と、書いたコードの量そのものがGPTより多くなっています。
まとめ:筆者はOpus 5.5推し
| 観点 | 勝者 |
|---|---|
| 見た目のインパクト・アニメOPらしさ | Claude |
| 盛り上がり・テンポ | Claude |
| もう一度見たくなるか | Claude |
| 単価 | Claude(GPTの半分以下) |
| キャラクター・世界観の作り込み | GPT |
| 音と映像の同期精度 | GPT |
| Go縛りのまま完走 | GPT |
| 納品物の手堅さ(検証・README) | GPT |
| 速さ(制作・書き出し) | GPT |
| 今回の総コスト | GPT(Claudeは文脈が重い状態で開始) |
| 個人的な好み | Claude |
項目の数だけ見ればGPTが多く勝っています。それでも筆者はOpus 5.5を推します。
今回のお題は「存在しないアニメのOP」で、評価ポイントは「見た目のインパクト」と「もう一度見たくなるか」でした。この2つで勝ったのはClaudeです。GPTの作品は丁寧で正確でしたが、見終わったあとに残ったのは「きれいなPV」という印象でした。Claudeの作品は「このアニメ、1話見てみたい」と思わせてくれました。
しかも単価はGPTの半分以下です。今回は前の作業の文脈を抱えたまま始めたせいで総額が逆転しましたが、条件をそろえれば「安くて、ワクワクするほう」になります。
- 「とにかく刺さる1本を作って」なら Claude Opus 5.5。 演出の引き出しが多く、ネタも仕込んでくれます。縛りが重要な場面では、今回のように「この条件のままでいい?」と確認してくれるので、人間が判断すれば大丈夫です
- 「仕様どおりに、検証付きで納品して」なら GPT-6 Astra。 縛りを守り、数値で裏付けて、速く仕上げます。ただし演出は優等生的で、盛り上がりは控えめです
みなさんはどっちが好きでしたか? コメントで教えてください。





