0
0

Delete article

Deleted articles cannot be recovered.

Draft of this article would be also deleted.

Are you sure you want to delete this article?

Claude Code Max $200/月×8ヶ月を私のタスク別に分解 — 4割はローカルLLMで代替できました

0
Last updated at Posted at 2026-07-28

Claude Code Max 8ヶ月のタスク別コスト分解

先に結論を書きます。

私はClaude Code Maxの$200/月プランを8ヶ月続けました。累計32万円。使用ログを7カテゴリに分解して、各カテゴリを「RTX 4070 + Qwen 3.6 35B-A3B」で代替できるかを判定したところ、時間換算で約4割はローカルLLMで置き換え可能でした。残り6割は代替不可です。

ちなみに「4割は代替可能だった」と気づくのに32万円かかったので、授業料としてはやや割高です。

「Claude Code Maxは高い」も「安い」も、両方まちがいです。タスク別に見なければ意味がない金額です。この記事では、8ヶ月分の使用ログを月別・カテゴリ別に集計し、どこがローカル代替可能で、どこが代替不可なのかを実測で切り分けます。

なお本記事は、2026年08月から予告されているAnthropicの課金変更(Max従量制化)の、固定額プラン下での8ヶ月実測です。従量制移行後は同じ使用パターンでも金額が変わる可能性が高いので、その位置づけを最初に置いておきます。

この記事のスコープと、既存記事との差分

同ジャンルで書き分けが必要なので、位置づけを明示します。

  • 「RTX 4070でローカルLLMの電気代を24時間計測」: 24時間の累積電気代(円)
  • 「ネットにもAPIにも繋がず、ローカルQwen 35Bでコーディングエージェントを動かす」: 完全ローカル運用の構築記
  • 「Claude Code・Cursor・Codex、結局どう使い分けるのが正解か」: 3ツール横比較
  • 本記事: Claude Code Max単体を8ヶ月、7カテゴリ×月別で分解し、カテゴリごとにローカル代替可否を判定

8ヶ月分の使用ログ(月別 × 7カテゴリ)

私はClaude Codeの session.jsonl と、claude-code-usage --json の日次ダンプを毎晩バックアップしています。そこから8ヶ月分をカテゴリ別に集計しました。カテゴリは以下の7つです。

  1. コード生成: 新規ファイル/新規関数の実装
  2. リファクタ: 既存コードの構造変更(挙動を変えない)
  3. レビュー: 差分読解、バグ指摘、命名レビュー
  4. 議事録: mtg文字起こしからの要約・アクション抽出
  5. 翻訳: JA↔EN/PT/ES(記事・READMEの一次翻訳)
  6. 検索: リポジトリ内・Web検索と要約
  7. デバッグ: エラーログの分解、根本原因の仮説立て

月別にセッション時間(Claude Codeが動いていた実時間、waitは除く)で並べたのが以下です。単位は分、n=1(私1人の実運用データ)、24時間×5日/週稼働の月あり。

コード生成 リファクタ レビュー 議事録 翻訳 検索 デバッグ 合計(h)
2025-12 1,850 720 610 280 340 720 480 83.3
2026-01 2,120 810 690 320 380 810 540 95.0
2026-02 1,780 690 580 260 320 680 460 79.5
2026-03 2,340 890 760 350 420 890 590 104.0
2026-04 2,010 780 660 300 360 770 520 90.0
2026-05 2,470 950 810 370 450 940 620 110.2
2026-06 2,180 840 720 330 400 830 550 97.5
2026-07 2,050 790 680 310 380 790 520 92.0
合計 16,800 6,470 5,510 2,520 3,050 6,430 4,280 751.5
割合 37.2% 14.3% 12.2% 5.6% 6.8% 14.2% 9.5% 100%

$200/月固定なので、$/カテゴリ換算は「$200 × 各カテゴリの時間割合」で近似できます。

コード生成に月$74.4、リファクタに月$28.6、レビューに月$24.4、検索に月$28.4、デバッグに月$19.0、翻訳に月$13.6、議事録に月$11.2。ここが支出の内訳です。

各カテゴリ、ローカルLLMで代替できたか

代替LLMはRTX 4070(12GB VRAM) + Qwen 3.6 35B-A3B(MoE、GGUF Q4_K_M、cpu-moe有効)。beam推論ではなくgreedy、context長は32k(実用範囲)で運用しました。同じプロンプトをローカルとClaude Code Maxの両方で実行し、以下の基準で「代替可」を判定しました。

  • 出力の妥当性: 私が最終採用したコードに対し、ローカル出力の修正コストがClaude Codeの2倍以内
  • 待ち時間: 同じ長さの出力で3倍以内(Qwen 35Bで大体40-60 tok/s decode)
  • 文脈: 32k tokenで足りるタスク

判定結果です。

7カテゴリ×代替可否×コスト影響

コード生成(37.2%): 部分代替

新規ファイルの雛形や、既存パターンの複製、ちょっとしたユーティリティ関数は、ローカルで十分でした。私の実感では、単一ファイル完結・200行以下・既存パターン踏襲のコードは95%が代替可能です。

ダメだったのは以下です。

  • 複数ファイルにまたがるリファクタ + テスト追加を1発でやるケース
  • ツール(MCP、Playwright、Bash)を跨いだ実装(ローカルは Agent SDK 未対応で連携できず)
  • ライブラリの最新仕様に依存する実装(Qwen 3.6 のカット日は2026-03。それ以降のAPIは知らない)

代替可能率は時間ベースで約60%。$/月換算で$44.6が代替可、$29.8がClaude Code必須です。

リファクタ(14.3%): 高代替

「関数抽出・命名変更・型付け追加」レベルのリファクタは、ローカルで98%こなせます。理由は、リファクタは新規発想が要らないからです。既存のコードをパターンに沿って整形するだけなので、Qwen 35Bでもほぼ差が出ませんでした。

代替可能率は約90%。$/月換算で$25.7が代替可。

レビュー(12.2%): 部分代替

差分数百行の意図抽出・命名フィードバックは代替可。ただし、アーキテクチャ判断が絡むレビュー(「この抽象は早すぎる」「この境界はここではない」)はOpus級推論が必要で、ローカルでは論点を外します。

代替可能率は約55%

議事録(5.6%): 完全代替

mtg文字起こしから要約とアクション抽出は、Qwen 35Bで完璧に代替可能です。私は7ヶ月目からmtg議事録用途を完全にローカル移行しました。Claude Codeでやる合理的な理由がありません。

代替可能率は約100%。$/月換算で$11.2が代替可。

翻訳(6.8%): 完全代替

JA↔EN一次翻訳もローカルで十分でした。専門用語の統一・トーン調整は最終的に人間の手直しが要るのはどちらも同じで、質の差は生じません。

代替可能率は約100%。$/月換算で$13.6が代替可。

検索(14.2%): 代替不可

これがローカル代替の最大の壁です。Claude CodeのWebSearch/WebFetch/context-forge検索は、リアルタイム性 + 大きな文脈での要約力が必要で、ローカル32k contextでは物理的に足りません。

代替可能率は約10%。$/月換算で$25.5がClaude Code必須。

デバッグ(9.5%): 部分代替

kubectl logsjournalctl を人力で貼り付けて仮説を出させる用途はローカルでいけます。ただし、**Bashやgrepを能動的に叩いて原因を追う「エージェント的デバッグ」**は、Agent SDKが必要でローカル不可です。

代替可能率は約40%

8ヶ月合計 : 代替可能率と実質コスト

上記を合算します。

カテゴリ 割合 代替可能率 代替可時間 代替不可時間
コード生成 37.2% 60% 22.3% 14.9%
リファクタ 14.3% 90% 12.9% 1.4%
レビュー 12.2% 55% 6.7% 5.5%
議事録 5.6% 100% 5.6% 0.0%
翻訳 6.8% 100% 6.8% 0.0%
検索 14.2% 10% 1.4% 12.8%
デバッグ 9.5% 40% 3.8% 5.7%
合計 100% 59.5% 40.3%

時間ベースで約4割はローカルLLMに移行可能、6割はClaude Code Max必須。金額に直せば、$200/月のうち$80分はローカル代替候補、$120分は代替不可です。

私はいま、議事録・翻訳・簡易リファクタをローカルに完全移行し、Claude Codeプランを$200/月維持したまま「使いどころを絞る」運用にしました。ムダを削るのではなく、入り口を分ける発想です。

「代替不可な6割」の中身

代替不可な6割の内訳を1文で:

Opus級推論(アーキテクチャ判断)巨大コンテキスト(数十ファイル同時読解)ツール協調(MCP/Bash/Playwright を1タスクで束ねる)

この3つはローカルLLMがハードで詰みます。VRAM 12GBの制約でcontext 32kが実質限界、Agent SDKもない、tool useの学習も不足。この3領域に月$120を払うかは、個人事業主として「機械にやらせないと1日終わらないタスクがあるか」で決まります。私はある、と判断しました。

具体例で書きます。私が先週やった作業のうち、ローカルでは無理だったのは以下です。

  • Next.js 15 App Routerでリンク構造を作り直し、既存の32ファイルからimportパスを一括修正しつつ、テストを通す(context数十万トークン + Bash + npm test の反復)
  • MCPサーバーの認証周りの脆弱性チェック(WebSearch でCVE参照 + git blame でregressionを追う複合作業)
  • 商用RAGパイプラインのdebug(Playwright でE2E再現 + logs解読 + 修正 + 再度Playwrightで確認までを一連の会話で回す)

この3つはどれも、単一のプロンプト応答では終わりません。ツールを叩いて結果を受けて次を判断する反復が必要で、そこがローカルLLMには構造的に足りていません。Qwen 35B自体は賢いのですが、Agent側の実装が追いついていない、という印象です。

運用切り替えの具体的なワークフロー

「代替可なタスクをローカルに移す」を実務でどう回しているかも書いておきます。

私は Claude Codeを起動する前に、その日のタスクを頭の中で3分類します。

  1. 議事録・翻訳: 最初からOllama + Qwen 35Bで別ターミナルを開く。Claude Codeは開かない
  2. リファクタ・単一ファイル生成: まずローカルに投げる。90秒待って出力が微妙なら Claude Code に切替
  3. 検索・複数ファイル・デバッグ: 最初から Claude Code

この分岐だけで、Claude Code のセッション時間が体感で3割減りました。従量制移行後は、この3割ぶんが直接コスト削減に効く見込みです。

Ollama側のセットアップは、ollama pull qwen2.5:32b-instruct-q4_K_M (Qwen 3.6が来る前は 2.5 を使っていました)一発です。Qwen 3.6 35B-A3Bも今月からOllama公式レジストリで配布が始まり、ollama pull qwen3.6:35b-a3b で入ります。RTX 4070 12GB + cpu-moeで40-60 tok/s decode(私の実測、初回prompt-evalは200 tok/s ぐらい)。

議事録用途はさらに簡単で、私はShortcutで ⌘+⌥+M に「録音ファイルをQwen 35Bに投げて要約」を割り当てています。mtg終了→Shortcut発火→3分待つ→議事録がクリップボードに、というフローです。Claude Codeを開くよりずっと速いです。待ちの3分でコーヒーを淹れているので、節約したClaude Code代の一部は普通に豆代へ化けています。

実測値の注意点と限界

数字は私1人・8ヶ月・1環境の実測です。以下の限界があります。

  • セッション時間はwaitを含まない: 手が止まっている時間は除外しています。実際に机の前に座っていた時間はもっと長いです
  • 代替可判定は私の主観: 「修正コストが2倍以内」は私の合意基準で、他の人にはもっと厳しくもゆるくもなり得ます
  • Qwen 3.6 35B-A3Bのカット日は2026-03: それ以降のAPI・ライブラリ変更は知らないので、その領域は判定が甘くなっている可能性があります
  • 私は特に「テスト自動化」「議事録」「翻訳」の比率が高い: フロントエンド専業の人はカテゴリ比率が違うはずで、代替率の絶対値もズレます

数字はあくまで構造の参考として使ってください。カテゴリ別に分解する発想自体は誰にでも移植できます。

08月からのAnthropic課金変更を前に

2026-08 からClaude Code Maxが従量制に近い体系へ変わる予告があります(公式発表待ち)。従量制になると、上のカテゴリのうち**「翻訳」「議事録」のように大量トークンを吐かせがちなタスク**が支出を押し上げる可能性が高いです。

固定額プラン下でこの2カテゴリを流し放題にしていた運用は、従量制移行後にコスト構造が変わるので、今からローカル移行を仕込んでおくのは合理です。私は6月時点でその判断をし、月11時間ぶんの負荷をローカルに逃がしました。

まとめ

  • 8ヶ月 × 7カテゴリで見ると、時間換算4割はローカルLLM代替可能
  • 代替可能な内訳: リファクタ(90%)、議事録(100%)、翻訳(100%)、コード生成(60%)、レビュー(55%)、デバッグ(40%)
  • 代替不可なのは検索(10%代替) と、Opus級推論・巨大コンテキスト・ツール協調の3領域
  • 「Claude Code Maxは高い/安い」の議論は無意味、タスク別に見て初めて意味が出る金額

参考: Claude Code運用の書籍

Claude Codeの日次運用フローとタスク分解のコツは、こちらの本にまとめています。

私を離陸させたClaude Code入門(kenimoto.dev)

0
0
0

Register as a new user and use Qiita more conveniently

  1. You get articles that match your needs
  2. You can efficiently read back useful information
  3. You can use dark theme
What you can do with signing up
0
0

Delete article

Deleted articles cannot be recovered.

Draft of this article would be also deleted.

Are you sure you want to delete this article?