はじめに
2026年9月29日、OpenAI の DevDay で GPT-6.1 Sol が公開されました。9月22日に出た GPT-6 Sol の後継で、API ドキュメントでは「Astra に迫る性能を、より低いコストで」と説明されています。OpenAI の発表では、標準 API 価格が GPT-6 Astra の5分の1です。
押さえておきたい点は次の4つです。
- 価格は入力 $2 / 出力 $10 per 1M tokens。Astra は $10 / $50 なので、ちょうど5分の1。GPT-6 Sol と同じ単価のまま、DeepSWE v1.1 で GPT-6 Sol の最高スコア(68.8%)を超える 75.2% を出した
- キャッシュ入力は $0.10 で、GPT-6 Sol の $0.20 から半額になった
- ChatGPT では ChatGPT Work と Codex、API では
gpt-6.1-solで使える。速度重視の Ultrafast は、GPT-6.1 Sol 向けには「近日」の予告で、価格表にもまだ載っていない - API では reasoning effort の
noneとminimalが使えず、ツール呼び出しは Responses API が必須になる
OpenAI API や Codex で GPT-6 系を使っている開発者向けに、移行判断に必要な情報をまとめます。数値と仕様は、2026年10月7日時点の OpenAI 公式ドキュメントに基づいています。
モデルスペック
| 項目 | GPT-6.1 Sol |
|---|---|
| モデルID |
gpt-6.1-sol(スナップショットはこの1つだけ) |
| リリース日 | 2026年9月29日 |
| 入力価格 | $2 / 1M tokens |
| キャッシュ入力 | $0.10 / 1M tokens |
| キャッシュ書き込み | $2.50 / 1M tokens |
| 出力価格 | $10 / 1M tokens |
| 272K tokens 超の入力 | 入力 $4 / キャッシュ入力 $0.20 / キャッシュ書き込み $5 / 出力 $15 |
| Batch / Flex | 標準の50%引き |
| Fast モード | 標準の2倍の価格 |
| 地域処理(データレジデンシー) | 10%の上乗せ |
| コンテキストウィンドウ | 1,050,000 tokens(最大入力 922,000) |
| 最大出力 | 128,000 tokens |
| 知識カットオフ | 2026年4月30日 |
| 入力 / 出力 | テキスト・画像 / テキストのみ(音声・動画は非対応) |
| reasoning effort |
low / medium(デフォルト)/ high / xhigh / max。none と minimal は非対応 |
| エンドポイント | Responses(ツール呼び出しはこちら)/ Chat Completions(ツール呼び出しなし)/ Batch |
| 対応機能 | ストリーミング、structured outputs、関数呼び出し、ファイル検索、画像入力、Web 検索、プロンプトキャッシュ。ファインチューニングと predicted outputs は非対応 |
| データレジデンシー | US・EU に対応。EU では Fast モードが使えない |
| ChatGPT の対象プラン | Plus / Pro / Business / Enterprise / Edu(ChatGPT Work と Codex) |
レート制限(標準ティア)は、Build が 5,000 RPM / 1,000,000 TPM、Launch が 10,000 RPM / 4,000,000 TPM、Grow が 15,000 RPM / 40,000,000 TPM です。10月6日に、API の利用ティアは Build・Launch・Grow の3つに整理されました。
GPT-6世代の価格の位置づけ
| モデル | 入力 | キャッシュ入力 | 出力 |
|---|---|---|---|
| GPT-6 Astra | $10 | $1.00 | $50 |
| GPT-6.1 Sol | $2 | $0.10 | $10 |
| GPT-6 Sol | $2 | $0.20 | $10 |
| GPT-6 Luna | $0.10 | $0.01 | $0.50 |
| (参考)Claude Opus 5.5 | $4 | $0.20 | $20 |
| (参考)Claude Sonnet 5.5 | $2 | $0.20 | $10 |
GPT-6 Sol と同額で、キャッシュだけ安くなりました。Astra とは5倍、Opus 5.5 とは半額の差があり、Sonnet 5.5 とは同じ価格帯です。
主要な新機能・変更点
1. Astra に近い性能を5分の1の価格で
OpenAI の発表では、GPT-6.1 Sol は GPT-6 Sol をアップグレードしたモデルで、複雑なコーディング、コンピュータ操作、専門業務が対象です。「Using GPT-6」ガイドは、GPT-6.1 Sol を「Astra に近い性能を低コストで求めるとき」の選択肢とし、自分のタスクで Astra と比べて、品質とコストのトレードオフを見るよう案内しています。
2. 事実性とエラー報告の改善
低い reasoning effort での事実誤りを含む応答の割合は、GPT-6 Sol の 11.4% から 7.7% に下がりました(約32%減)。
システムカードの補遺には、検索が必要なタスクで「検索ツールが使えなかったことを最終回答で伝えない」割合が、GPT-6 Sol の 4.92% に対して GPT-6.1 Sol は 2.08% だったと書かれています。
エージェントが裏で失敗を握りつぶさないかは、実運用だと正答率より効いてくる場面があります。
3. キャッシュ読み取りが半額に
キャッシュ入力は $0.10 で、通常の入力より95%安く、GPT-6 Sol のキャッシュ入力よりも50%安くなりました。同じシステムプロンプトやリポジトリの文脈を何度も読ませるエージェント用途では、請求額への効きが大きいです。
4. Ultrafast は GPT-6.1 Sol では「近日」
OpenAI は、速度重視の有料ティア Ultrafast を発表しました。Codex では最大8倍(300トークン/秒)、API では最大6倍の速さとされています。
現時点で提供されているのは Astra 向けで、API では Responses API の service_tier: "ultrafast" で指定できます(9月29日の変更履歴)。価格ページの Ultrafast の表には gpt-6-astra の行しかなく、入力 $60 / キャッシュ入力 $6 / キャッシュ書き込み $75 / 出力 $300 です。GPT-6.1 Sol の Ultrafast は DevDay の発表で「近日」とされているだけで、価格表にも、GPT-6.1 Sol のモデルページにも、まだ載っていません。
5. DevDay のほかの発表
同じ DevDay では、次のものが発表されています。
- Codex: Codex Cloud、Codex CLI の
/agentsビューと双方向の音声操作、クラウドでのコードレビュー、脆弱性をスキャンする Codex Security Cloud - Agents API: パブリックベータ。ホスト実行、メモリ、ツール、マルチエージェントに対応し、computer use も使える
- Responses API のマルチエージェント: ベータ(9月29日の変更履歴)
- Decisions API: DevDay では限定プレビューとして発表され、10月6日にパブリックベータ(
gpt-6-luna専用)になった。詳細は GPT-6 Luna の記事に書いた - ChatGPT Pro 500: Plus の25倍の利用枠と Ultrafast が付く
ベンチマーク結果
OpenAI が公式の開発者向け投稿で示した数値です。比較対象とコストの比は、OpenAI の説明に従っています。
| ベンチマーク | GPT-6.1 Sol | 比較 |
|---|---|---|
| DeepSWE v1.1(実コードベースの複雑なソフトウェア工学) | 75.2%(high) | GPT-6 Sol の最高 68.8%(max)を上回り、タスクあたりコストは約76%低い。Astra と同等で、コストは約5分の1 |
| AutomationBench(複数アプリにまたがる業務) | 31.7%(medium) | 同じ設定の GPT-6 Sol より +4.8pt。Opus 5.5 より +2.2pt(medium)で、コストは約3分の1 |
| OSWorld 2.0(オフライン、computer use) | 71.4%(max) | Astra は 73.5%(max)。タスクあたりコストは約7分の1 |
| Terminal-Bench Science 0.1(科学系ワークフロー) | GPT-6 Sol の2倍超(max) | 1タスク平均 $5.47。Opus 5.5 は $23.21、Astra は $23.80 |
| GDP.pdf(専門業務の PDF に基づく質問) | Opus 5.5(fallback あり)を上回る | 試した reasoning 設定すべてで、コストは半分未満 |
括弧内は、そのスコアを出したときの reasoning effort です。GPT-6.1 Sol が Astra を超えた項目は、この表にはありません。差が小さい割に価格差が大きい、というのが今回の売りです。
システムカードの Preparedness Framework の分類
システムカードの補遺には、Preparedness Framework の分類として、次のように書かれています。
- "treating GPT-6.1 Sol as Critical capability in the Cybersecurity domain"
- "treating GPT-6.1 Sol as High capability in the Biological and Chemical domain"
セキュリティ領域で使う場合や、安全対策の運用を確認したい場合は、補遺を直接読んでください。
API移行時の注意点(Breaking Changes)
⚠️ reasoning effort の none と minimal が使えない
GPT-6 Astra と GPT-6.1 Sol は none に対応していません。公式の移行ガイドは、none を使っていた箇所は low にするよう案内しています。minimal を使っていた箇所も、まず low から始めて結果を比べます。レイテンシを詰めるために none で動かしていた経路は、応答時間と品質を測り直してください。
⚠️ ツール呼び出しは Responses API が必須
公式ガイドの記述は、「Astra と GPT-6.1 Sol は Chat Completions にも対応するが、ツール呼び出しは Responses が必須」です。GPT-6 Sol と GPT-6 Luna は、Chat Completions の関数呼び出しが reasoning_effort: "none" のときだけ使えました。GPT-6.1 Sol は none が使えないので、ツールを使う処理は Responses API に移す必要があります。
# Before: GPT-6 Sol。Chat Completions + effort none でツールを呼んでいた例
client.chat.completions.create(
model="gpt-6-sol",
reasoning_effort="none",
tools=[...],
messages=[...],
)
# After: GPT-6.1 Sol。Responses API に移し、effort は low 以上にする
client.responses.create(
model="gpt-6.1-sol",
reasoning={"effort": "low"},
tools=[...],
input=[...],
)
⚠️ サンプリングパラメータを外す
公式の移行手順に、「reasoning effort が none でないときは、temperature・top_p・top_logprobs を外す」とあります。GPT-6.1 Sol は none が使えないので、これらは常に外します。
⚠️ GPT-5.5 以前から移るなら、キャッシュの指定も変える
prompt_cache_retention は prompt_cache_options.ttl に置き換えます。公式ガイドの例は "30m" です。
⚠️ 272K tokens を超えると単価が上がる
コンテキストは1,050,000 tokens まで使えますが、入力が272K を超えると、入力とキャッシュの単価が2倍、出力が1.5倍になります。長い文脈を毎回丸ごと投げる設計だと、想定より高くなることがあります。
⚠️ Ultrafast を見積もりに入れない
GPT-6.1 Sol の Ultrafast は、価格も提供日も出ていません。速度要件が厳しい設計は、標準速度でも成り立つ前提で組み、Ultrafast は提供後に切り替える形が現実的です。Fast モードは標準の2倍の価格で、EU のデータレジデンシーでは使えません。
✅ 公式の移行手順で確認する項目
公式の手順では、次の5点を確認します。
-
modelにgpt-6.1-solを指定する - reasoning effort(
none/minimalは使えない) - ツール呼び出しの方式(Responses)
- 不要なパラメータ(
temperatureなど) - データレジデンシーの要件
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-6.1-sol",
reasoning={"effort": "medium"}, # low / medium / high / xhigh / max
tools=[{"type": "web_search"}],
input=[{"role": "user", "content": "このリポジトリの依存関係の脆弱性を調べて、修正方針をまとめて"}],
)
print(response.output_text)
「Using GPT-6」ガイドには、GPT-6 の新機能として、ツール実行中も推論を続けられる非同期ツール呼び出し、作業中に追加の指示を送れる mid-turn steering、会話の途中で configuration_update 入力アイテムによって reasoning effort を上げ下げする機能が載っています。
まとめ
GPT-6.1 Sol は、Astra に近い性能を5分の1の価格で使えるようにした更新です。GPT-6 Sol と単価が同じで性能が上がり、キャッシュも半額になったので、GPT-6 Sol からの移行は基本的に得です。
-
GPT-6 Sol を使っている:
none/minimalを使っていないか、Chat Completions でツールを呼んでいないかを確認する。サンプリングパラメータも外す - Astra を使っている: 難しい処理は Astra に残し、コーディングやコンピュータ操作の多くを GPT-6.1 Sol に振り分けると、コストが大きく下がる可能性がある。差が出る処理は自分のタスクで確認する
- Claude Sonnet 5.5 や Opus 5.5 と比べている: Sonnet 5.5 とは同じ価格帯で、Opus 5.5 とは半額の差。OpenAI は AutomationBench や GDP.pdf で Opus 5.5 を上回ったとしているが、ベンダー公表値なので、手元のタスクで比較したい
- 長文脈を使う: 272K を超えると割増になるので、キャッシュと入力の絞り込みを設計に入れる
- 速度が要る: GPT-6.1 Sol の Ultrafast は提供待ち。標準速度で成り立つ設計にしておく
この記事の情報源について
OpenAI の API ドキュメント(モデルページ・価格ページ・変更履歴・「Using GPT-6」ガイド)、DevDay と GPT-6.1 Sol の公式開発者コミュニティ投稿、システムカード補遺で確認できた内容だけを書いています。openai.com の発表ページは直接取得できなかったため、ベンチマークの数値は、公式の開発者コミュニティ投稿で確認できたものに限っています。
参考リンク
- OpenAI:Introducing GPT-6.1 Sol
- OpenAI API Docs:GPT-6.1 Sol Model
- OpenAI API Docs:Using GPT-6
- OpenAI API Docs:Pricing
- OpenAI API Docs:Changelog
- OpenAI Developer Community:GPT-6.1 Sol in the API: a meaningful step up in cost-performance
- OpenAI Developer Community:DevDay 2026 announcements and developer resources
- OpenAI Deployment Safety Hub:Addendum to GPT-6 Astra System Card: GPT-6.1 Sol
- OpenAI API Docs:GPT-6 Astra Model
- OpenAI API Docs:GPT-6 Sol Model