0
0

Delete article

Deleted articles cannot be recovered.

Draft of this article would be also deleted.

Are you sure you want to delete this article?

【2026年9月】GPT-6.1 SolがDevDayで登場!Astraに迫る性能を5分の1の価格で・API変更点まとめ

0
Posted at

はじめに

2026年9月29日、OpenAI の DevDay で GPT-6.1 Sol が公開されました。9月22日に出た GPT-6 Sol の後継で、API ドキュメントでは「Astra に迫る性能を、より低いコストで」と説明されています。OpenAI の発表では、標準 API 価格が GPT-6 Astra の5分の1です。

押さえておきたい点は次の4つです。

  • 価格は入力 $2 / 出力 $10 per 1M tokens。Astra は $10 / $50 なので、ちょうど5分の1。GPT-6 Sol と同じ単価のまま、DeepSWE v1.1 で GPT-6 Sol の最高スコア(68.8%)を超える 75.2% を出した
  • キャッシュ入力は $0.10 で、GPT-6 Sol の $0.20 から半額になった
  • ChatGPT では ChatGPT Work と Codex、API では gpt-6.1-sol で使える。速度重視の Ultrafast は、GPT-6.1 Sol 向けには「近日」の予告で、価格表にもまだ載っていない
  • API では reasoning effort の none と minimal が使えず、ツール呼び出しは Responses API が必須になる

OpenAI API や Codex で GPT-6 系を使っている開発者向けに、移行判断に必要な情報をまとめます。数値と仕様は、2026年10月7日時点の OpenAI 公式ドキュメントに基づいています。


モデルスペック

項目 GPT-6.1 Sol
モデルID gpt-6.1-sol(スナップショットはこの1つだけ)
リリース日 2026年9月29日
入力価格 $2 / 1M tokens
キャッシュ入力 $0.10 / 1M tokens
キャッシュ書き込み $2.50 / 1M tokens
出力価格 $10 / 1M tokens
272K tokens 超の入力 入力 $4 / キャッシュ入力 $0.20 / キャッシュ書き込み $5 / 出力 $15
Batch / Flex 標準の50%引き
Fast モード 標準の2倍の価格
地域処理(データレジデンシー) 10%の上乗せ
コンテキストウィンドウ 1,050,000 tokens(最大入力 922,000)
最大出力 128,000 tokens
知識カットオフ 2026年4月30日
入力 / 出力 テキスト・画像 / テキストのみ(音声・動画は非対応)
reasoning effort low / medium(デフォルト)/ high / xhigh / max。none と minimal は非対応
エンドポイント Responses(ツール呼び出しはこちら)/ Chat Completions(ツール呼び出しなし)/ Batch
対応機能 ストリーミング、structured outputs、関数呼び出し、ファイル検索、画像入力、Web 検索、プロンプトキャッシュ。ファインチューニングと predicted outputs は非対応
データレジデンシー US・EU に対応。EU では Fast モードが使えない
ChatGPT の対象プラン Plus / Pro / Business / Enterprise / Edu(ChatGPT Work と Codex)

レート制限(標準ティア)は、Build が 5,000 RPM / 1,000,000 TPM、Launch が 10,000 RPM / 4,000,000 TPM、Grow が 15,000 RPM / 40,000,000 TPM です。10月6日に、API の利用ティアは Build・Launch・Grow の3つに整理されました。


GPT-6世代の価格の位置づけ

モデル 入力 キャッシュ入力 出力
GPT-6 Astra $10 $1.00 $50
GPT-6.1 Sol $2 $0.10 $10
GPT-6 Sol $2 $0.20 $10
GPT-6 Luna $0.10 $0.01 $0.50
(参考)Claude Opus 5.5 $4 $0.20 $20
(参考)Claude Sonnet 5.5 $2 $0.20 $10

GPT-6 Sol と同額で、キャッシュだけ安くなりました。Astra とは5倍、Opus 5.5 とは半額の差があり、Sonnet 5.5 とは同じ価格帯です。


主要な新機能・変更点

1. Astra に近い性能を5分の1の価格で

OpenAI の発表では、GPT-6.1 Sol は GPT-6 Sol をアップグレードしたモデルで、複雑なコーディング、コンピュータ操作、専門業務が対象です。「Using GPT-6」ガイドは、GPT-6.1 Sol を「Astra に近い性能を低コストで求めるとき」の選択肢とし、自分のタスクで Astra と比べて、品質とコストのトレードオフを見るよう案内しています。

2. 事実性とエラー報告の改善

低い reasoning effort での事実誤りを含む応答の割合は、GPT-6 Sol の 11.4% から 7.7% に下がりました(約32%減)。

システムカードの補遺には、検索が必要なタスクで「検索ツールが使えなかったことを最終回答で伝えない」割合が、GPT-6 Sol の 4.92% に対して GPT-6.1 Sol は 2.08% だったと書かれています。

エージェントが裏で失敗を握りつぶさないかは、実運用だと正答率より効いてくる場面があります。

3. キャッシュ読み取りが半額に

キャッシュ入力は $0.10 で、通常の入力より95%安く、GPT-6 Sol のキャッシュ入力よりも50%安くなりました。同じシステムプロンプトやリポジトリの文脈を何度も読ませるエージェント用途では、請求額への効きが大きいです。

4. Ultrafast は GPT-6.1 Sol では「近日」

OpenAI は、速度重視の有料ティア Ultrafast を発表しました。Codex では最大8倍(300トークン/秒)、API では最大6倍の速さとされています。

現時点で提供されているのは Astra 向けで、API では Responses API の service_tier: "ultrafast" で指定できます(9月29日の変更履歴)。価格ページの Ultrafast の表には gpt-6-astra の行しかなく、入力 $60 / キャッシュ入力 $6 / キャッシュ書き込み $75 / 出力 $300 です。GPT-6.1 Sol の Ultrafast は DevDay の発表で「近日」とされているだけで、価格表にも、GPT-6.1 Sol のモデルページにも、まだ載っていません。

5. DevDay のほかの発表

同じ DevDay では、次のものが発表されています。

  • Codex: Codex Cloud、Codex CLI の /agents ビューと双方向の音声操作、クラウドでのコードレビュー、脆弱性をスキャンする Codex Security Cloud
  • Agents API: パブリックベータ。ホスト実行、メモリ、ツール、マルチエージェントに対応し、computer use も使える
  • Responses API のマルチエージェント: ベータ(9月29日の変更履歴)
  • Decisions API: DevDay では限定プレビューとして発表され、10月6日にパブリックベータ(gpt-6-luna 専用)になった。詳細は GPT-6 Luna の記事に書いた
  • ChatGPT Pro 500: Plus の25倍の利用枠と Ultrafast が付く

ベンチマーク結果

OpenAI が公式の開発者向け投稿で示した数値です。比較対象とコストの比は、OpenAI の説明に従っています。

ベンチマーク GPT-6.1 Sol 比較
DeepSWE v1.1(実コードベースの複雑なソフトウェア工学) 75.2%(high) GPT-6 Sol の最高 68.8%(max)を上回り、タスクあたりコストは約76%低い。Astra と同等で、コストは約5分の1
AutomationBench(複数アプリにまたがる業務) 31.7%(medium) 同じ設定の GPT-6 Sol より +4.8pt。Opus 5.5 より +2.2pt(medium)で、コストは約3分の1
OSWorld 2.0(オフライン、computer use) 71.4%(max) Astra は 73.5%(max)。タスクあたりコストは約7分の1
Terminal-Bench Science 0.1(科学系ワークフロー) GPT-6 Sol の2倍超(max) 1タスク平均 $5.47。Opus 5.5 は $23.21、Astra は $23.80
GDP.pdf(専門業務の PDF に基づく質問) Opus 5.5(fallback あり)を上回る 試した reasoning 設定すべてで、コストは半分未満

括弧内は、そのスコアを出したときの reasoning effort です。GPT-6.1 Sol が Astra を超えた項目は、この表にはありません。差が小さい割に価格差が大きい、というのが今回の売りです。

システムカードの Preparedness Framework の分類

システムカードの補遺には、Preparedness Framework の分類として、次のように書かれています。

  • "treating GPT-6.1 Sol as Critical capability in the Cybersecurity domain"
  • "treating GPT-6.1 Sol as High capability in the Biological and Chemical domain"

セキュリティ領域で使う場合や、安全対策の運用を確認したい場合は、補遺を直接読んでください。


API移行時の注意点(Breaking Changes)

⚠️ reasoning effort の none と minimal が使えない

GPT-6 Astra と GPT-6.1 Sol は none に対応していません。公式の移行ガイドは、none を使っていた箇所は low にするよう案内しています。minimal を使っていた箇所も、まず low から始めて結果を比べます。レイテンシを詰めるために none で動かしていた経路は、応答時間と品質を測り直してください。

⚠️ ツール呼び出しは Responses API が必須

公式ガイドの記述は、「Astra と GPT-6.1 Sol は Chat Completions にも対応するが、ツール呼び出しは Responses が必須」です。GPT-6 Sol と GPT-6 Luna は、Chat Completions の関数呼び出しが reasoning_effort: "none" のときだけ使えました。GPT-6.1 Sol は none が使えないので、ツールを使う処理は Responses API に移す必要があります。

# Before: GPT-6 Sol。Chat Completions + effort none でツールを呼んでいた例
client.chat.completions.create(
    model="gpt-6-sol",
    reasoning_effort="none",
    tools=[...],
    messages=[...],
)

# After: GPT-6.1 Sol。Responses API に移し、effort は low 以上にする
client.responses.create(
    model="gpt-6.1-sol",
    reasoning={"effort": "low"},
    tools=[...],
    input=[...],
)

⚠️ サンプリングパラメータを外す

公式の移行手順に、「reasoning effort が none でないときは、temperature・top_p・top_logprobs を外す」とあります。GPT-6.1 Sol は none が使えないので、これらは常に外します。

⚠️ GPT-5.5 以前から移るなら、キャッシュの指定も変える

prompt_cache_retention は prompt_cache_options.ttl に置き換えます。公式ガイドの例は "30m" です。

⚠️ 272K tokens を超えると単価が上がる

コンテキストは1,050,000 tokens まで使えますが、入力が272K を超えると、入力とキャッシュの単価が2倍、出力が1.5倍になります。長い文脈を毎回丸ごと投げる設計だと、想定より高くなることがあります。

⚠️ Ultrafast を見積もりに入れない

GPT-6.1 Sol の Ultrafast は、価格も提供日も出ていません。速度要件が厳しい設計は、標準速度でも成り立つ前提で組み、Ultrafast は提供後に切り替える形が現実的です。Fast モードは標準の2倍の価格で、EU のデータレジデンシーでは使えません。

✅ 公式の移行手順で確認する項目

公式の手順では、次の5点を確認します。

  1. model に gpt-6.1-sol を指定する
  2. reasoning effort(none / minimal は使えない)
  3. ツール呼び出しの方式(Responses)
  4. 不要なパラメータ(temperature など)
  5. データレジデンシーの要件
from openai import OpenAI

client = OpenAI()

response = client.responses.create(
    model="gpt-6.1-sol",
    reasoning={"effort": "medium"},  # low / medium / high / xhigh / max
    tools=[{"type": "web_search"}],
    input=[{"role": "user", "content": "このリポジトリの依存関係の脆弱性を調べて、修正方針をまとめて"}],
)
print(response.output_text)

「Using GPT-6」ガイドには、GPT-6 の新機能として、ツール実行中も推論を続けられる非同期ツール呼び出し、作業中に追加の指示を送れる mid-turn steering、会話の途中で configuration_update 入力アイテムによって reasoning effort を上げ下げする機能が載っています。


まとめ

GPT-6.1 Sol は、Astra に近い性能を5分の1の価格で使えるようにした更新です。GPT-6 Sol と単価が同じで性能が上がり、キャッシュも半額になったので、GPT-6 Sol からの移行は基本的に得です。

  • GPT-6 Sol を使っている: none / minimal を使っていないか、Chat Completions でツールを呼んでいないかを確認する。サンプリングパラメータも外す
  • Astra を使っている: 難しい処理は Astra に残し、コーディングやコンピュータ操作の多くを GPT-6.1 Sol に振り分けると、コストが大きく下がる可能性がある。差が出る処理は自分のタスクで確認する
  • Claude Sonnet 5.5 や Opus 5.5 と比べている: Sonnet 5.5 とは同じ価格帯で、Opus 5.5 とは半額の差。OpenAI は AutomationBench や GDP.pdf で Opus 5.5 を上回ったとしているが、ベンダー公表値なので、手元のタスクで比較したい
  • 長文脈を使う: 272K を超えると割増になるので、キャッシュと入力の絞り込みを設計に入れる
  • 速度が要る: GPT-6.1 Sol の Ultrafast は提供待ち。標準速度で成り立つ設計にしておく

この記事の情報源について

OpenAI の API ドキュメント(モデルページ・価格ページ・変更履歴・「Using GPT-6」ガイド)、DevDay と GPT-6.1 Sol の公式開発者コミュニティ投稿、システムカード補遺で確認できた内容だけを書いています。openai.com の発表ページは直接取得できなかったため、ベンチマークの数値は、公式の開発者コミュニティ投稿で確認できたものに限っています。


参考リンク

0
0
0

Register as a new user and use Qiita more conveniently

  1. You get articles that match your needs
  2. You can efficiently read back useful information
  3. You can use dark theme
What you can do with signing up
0
0

Delete article

Deleted articles cannot be recovered.

Draft of this article would be also deleted.

Are you sure you want to delete this article?