2025年、Gemini・Claude・ChatGPTを本気で使い比べて分かったこと
ソフトウェアエンジニアとして、2025年は生成AIをほぼ毎日使った1年だった。
コード書き、ドキュメント作成、リサーチ、ブレスト。気づけば「AIなしで仕事してた頃どうしてたっけ?」と思うくらい染み付いた。で、3つの主要サービスを行ったり来たりした結果、それぞれの「向き不向き」がかなりはっきり見えてきたので、率直にまとめる。
注意: これは個人の使用感であって、ベンチマークスコアの比較記事ではない。「実際に使ってどうだったか」だけ書く。
使ったもの
- Claude (Sonnet 4.5 → Opus 4.5 → Sonnet 4.6): メインで一番使った
- Gemini (1.5 Pro → 2.0 → 2.5 Pro → 3.1 Pro): Googleエコシステムとの連携で使用
- ChatGPT (GPT-4o → o1 → o3 → GPT-5.3): 初期は一番使っていたが徐々に移行
コーディング: Claudeが頭一つ抜けている
正直に言うと、コード生成ではClaudeが一番信頼できた。
Claude Codeをターミナルで使い始めてからは特にそうで、「このファイルのこの関数をリファクタリングして」みたいな指示を出すと、コンテキストを正確に読み取って的確に修正してくれる。SWE-benchのスコアが高いのは伊達じゃないと実感した。
一方、ChatGPTのo3モデルは推論が丁寧で、アルゴリズム問題やロジック設計では強い。ただ、実際のプロジェクトコードを渡すと「動くけど微妙に既存の書き方と合わない」コードを出すことがあった。
Geminiはコード生成自体は悪くないが、2025年前半まではハルシネーションが気になった。3.1 Proになってかなり改善されたが、Claudeと比べると「コードの文脈理解」で差がある印象。
個人的な使い分け:
- 既存プロジェクトの修正・拡張 → Claude Code
- アルゴリズム設計・ロジック検討 → ChatGPT (o3)
- Google Cloud連携やAndroid開発 → Gemini
長文処理: Geminiの独壇場
ここはGeminiの圧勝。
100万トークンのコンテキストウィンドウは冗談じゃなく便利。長い仕様書PDFを丸ごと食わせて「この仕様のここが矛盾してない?」みたいな質問ができる。Claudeも200Kトークンあるし、実用上は十分なんだけど、「とにかく全部入れたい」ケースではGeminiに軍配が上がる。
実際に300ページくらいの技術仕様書を処理させたとき、Geminiは最後まで内容を把握していた。同じことをChatGPTでやろうとしたら、後半の内容を忘れがちだった(GPT-5.3で400Kまで拡張されたが、Geminiの100万にはまだ遠い)。
ただし、長文を入れたときの応答速度はChatGPTが一番速かった。Geminiは長文処理時にやや待たされる。
日常的な質問・ブレスト: ChatGPTの安定感
ChatGPTを最初に使い始めたのは多くの人と同じだと思う。で、2025年を通して感じたのは、「一般的な質問への回答品質」ではChatGPTが一番安定している。
理由は単純で、ウェブ検索との統合が最も自然。「最近の○○について教えて」系の質問で、検索結果をうまく組み込んだ回答を返してくれる。Claudeもウェブ検索はできるが、ChatGPTほどシームレスではなかった(最近かなり改善されたが)。
あと、GPTsの存在は大きい。よく使うプロンプトをGPTsとして保存しておけるのは地味に便利。Claudeにも「Projects」があるけど、GPTsの方が共有しやすい。
料金: ここが悩みどころ
2025年末時点での体感コスト:
| 用途 | 一番コスパ良かったの |
|---|---|
| API利用(大量処理) | Gemini(単価が安い) |
| 個人サブスク | ChatGPT Plus(機能の幅が広い) |
| コーディング特化 | Claude Pro(Claude Codeが使える) |
正直、全部サブスクすると月$60以上になる。自分は最終的にClaude Pro + ChatGPT Plusの2つに落ち着いた。Geminiは無料枠とAPI従量課金で使い分けている。
マルチモーダル: 三者三様
画像理解はGeminiが一番良かった。写真を見せて「これ何?」は3社ともできるけど、図表やグラフの読み取り精度ではGeminiが上。もともとGoogleが画像系に強いのもあると思う。
音声はChatGPTが圧倒的。Advanced Voiceは自然すぎて最初びっくりした。通勤中にイヤホンで「今日のタスク整理して」とか話しかけるのが日課になった。ClaudeとGeminiも音声対応はしているが、ChatGPTの会話体験には追いついていない。
動画理解はGeminiの独自機能で、YouTube動画の内容を要約させたりできる。これは他2社にはない強み。
正直、微妙だったところ
それぞれの「ここが惜しい」も書いておく。
Claude:
- 「できません」と断ることが多い。安全性重視なのは分かるが、明らかに問題ない質問でも断られることがある
- 日本語の敬語がやや硬い。ビジネス文書は良いが、カジュアルな文章は少し不自然になりがち
- 画像生成ができない(2025年中ずっと)
Gemini:
- UIが頻繁に変わる。操作に慣れた頃にまた変わる
- 回答が冗長になりやすい。「もっと簡潔に」と言わないと長々と書く
- 3.1 Pro以前はハルシネーションが目立った
ChatGPT:
- 最新モデル(o3、GPT-5.3)は応答が遅いことがある
- 回答がお世辞っぽい。「素晴らしい質問ですね!」はもういい
- プラグイン/GPTs周りが少しカオス。使いたい機能がどこにあるか迷う
2025年の総括
| 評価項目 | 1位 | 2位 | 3位 |
|---|---|---|---|
| コーディング | Claude | ChatGPT (o3) | Gemini |
| 長文処理 | Gemini | Claude | ChatGPT |
| 日常Q&A | ChatGPT | Claude | Gemini |
| マルチモーダル | Gemini | ChatGPT | Claude |
| 料金の安さ | Gemini | ChatGPT | Claude |
| 開発者ツール | Claude | Gemini | ChatGPT |
結局のところ、「全部で最強」のサービスは存在しない。だから使い分けるのが現実的な答えだった。
自分の場合、メインはClaude(特にコード作業)、日常使いにChatGPT、長い文書処理とGoogle連携にGeminiという形に落ち着いた。
2026年に向けて
3社とも進化のスピードがすごくて、半年前の評価が通用しないことが多い。2025年前半に「Geminiはちょっと...」と思っていたのが、3.1 Proで評価が変わった。Claudeもコーディング特化の姿勢を強めている。ChatGPTはGPT-5.3で推論力がさらに上がった。
2026年はエージェント機能の競争になると思う。Claude Code、Gemini Code Assist、ChatGPT Codex Appと、各社がAIに「自律的にタスクをこなさせる」方向に進んでいる。
個人的に注目しているのは:
- Claudeのマルチエージェント協調(Agent Teams)の進化
- GeminiのProject Marinerによるブラウザ自動化
- ChatGPT Codex Appのデスクトップ統合
どれが勝つかは分からないけど、開発者として全部触っておくのが吉だと思う。
この記事は Findy Team+ Advent Calendar 2025 「2025年、生成AIを使ってみてどうだった?」 キャンペーンへの参加記事です。