0
0

Delete article

Deleted articles cannot be recovered.

Draft of this article would be also deleted.

Are you sure you want to delete this article?

GPT-6.1 SolはAstraの5分の1の価格で本当に十分?「Critical」の意味

0
Last updated at Posted at 2026-10-03

GPT-6.1 SolはAstraの5分の1の価格で本当に十分?「Critical」の意味|グラレコ要約

📺 この記事は YouTube チャンネル きなこもっちーのテック深掘り の動画解説記事です。
▶️ 動画はこちら → GPT-6.1 SolはAstraの5分の1の価格で本当に十分?「Critical」の意味

🐹🦜 この記事に登場する2匹

  • 🐹 もっちー (ハムスター)… AI はまだ勉強中。「それどういうこと?」と素朴に質問する生徒役
  • 🦜 きなこ (セキセイインコ)… AI で調べものをこなす解説役。やさしく深掘りして教える先生役

この記事は2匹の掛け合いを書き起こした形式です。発言の先頭にいる絵文字+名前が話者です。

はじめに

🐹 もっちー「なあきなこ、OpenAIの新しいAI『GPT-6.1 Sol』、一番強いAstraにほぼ並ぶのに値段は5分の1らしいやん!そんなうまい話ある?」

🦜 きなこ「数字だけ見ると確かに魅力的なの。でもね、OpenAI自身が公開した安全評価では、サイバー分野の区分がいちばん上なんだよ」

🐹 もっちー「え、自分で危ないって言ってるの?」

予告テロップ:『安さの正体』と『Criticalの意味』の2つを提示

🦜 きなこ「『危ない』って意味とは少し違うの。サイバー分野の能力区分が、いちばん上の『Critical』なんだよ。今日はその意味を、安さの話と一緒に整理するね」

🐹 もっちー「安いのに慎重に扱う…ワイにはまだ矛盾に聞こえるわ」

🦜 きなこ「その違和感が、この動画のいちばんの見どころなの」

GPT-6.1 Solとは何か

導入カード:先週発表の GPT-6 Sol から、今週発表の GPT-6.1 Sol へ矢印でつなぐ(改良版)

🐹 もっちー「まず基本から教えてよ。GPT-6.1 Solって、先週出たGPT-6 Solの何が変わったの?」

発表カード:『GPT-6.1 Sol』発表日 2026-09-29(DevDay)/先週発表の GPT-6 Sol の改良版

🦜 きなこ「2026年9月29日、OpenAIの開発者向けイベントDevDayで発表されたの。GPT-6 Solの改良版っていう位置づけだよ」

🐹 もっちー「先週出たばっかりやのに、もう改良版?早ない?」

🦜 きなこ「本当に早いよね。OpenAIは、最上位のGPT-6 Astraに匹敵する能力を、速さと手頃さを両立して届けるって説明してるの」

🐹 もっちー「Astraって、一番強いモデルのことだよね?」

階層図:GPT-6 Astra(最上位)/GPT-6.1 Sol(Astraに近づけた実務向け)/GPT-6 Sol(旧版)

🦜 きなこ「そう。Astraが最上位で、Solはその下の実務向けモデル。今回は、そのSolをAstraに近づけたのがポイントなの」

🐹 もっちー「どこで使えるの?ワイでも触れる?」

提供範囲カード:ChatGPT Work/Codex(有料プラン)で提供・通常チャットは未対応(発表時点)

🦜 きなこ「発表時点では、ChatGPTの有料プランのWorkとCodexで使えると報じられているの。普通のチャットではまだなんだって」

🐹 もっちー「ワークとかコーデックスって何? ぼく、チャットしか使ったことないよ…」

🦜 きなこ「ワークは仕事の作業向けの機能、コーデックスはコードを書くための道具、くらいに思っておいてね。だから評価も、コードを書く、パソコンを操作する、資料を作る、みたいな仕事の作業が中心なの」

安さの正体

🐹 もっちー「で、肝心の値段は?5分の1ってどういう計算なの?」

価格比較表:GPT-6.1 Sol(入力$2/出力$10)と GPT-6 Astra(入力$10/出力$50)/100万トークンあたり

🦜 きなこ「報じられている標準APIの価格は、ふつうの長さの入力なら、100万トークンあたり入力が2ドル、出力が10ドル。Astraはその5倍の10ドルと50ドルだから、ちょうど5分の1なの」

🐹 もっちー「トークンって何やったっけ…文字の数みたいなもん?」

🦜 きなこ「文字を機械向けに細かく切った単位なの。文字数とぴったり同じじゃないけど、近いイメージでOKだよ。AIに読ませる量と書かせる量で料金が決まるの」

🐹 もっちー「安い安いって聞くけど、AIの料金って結局どう払うの?月額じゃないの?」

区別カード:ChatGPTなどのアプリ=月額プラン/今回の価格=API(従量課金)の料金

🦜 きなこ「ChatGPTみたいなアプリは月額のプランが多いの。今日の価格は、開発者がプログラムからAIを呼び出すAPIの料金の話だよ」

🐹 もっちー「へえ、アプリの料金とは別の話だったのか」

🐹 もっちー「なるほどね。じゃあ前の6 Solより安くなったの?」

差分カード:GPT-6 Sol → GPT-6.1 Sol/入出力価格は同じ/キャッシュ入力のみ約50%安い(報道ベース)

🦜 きなこ「入力と出力の価格はGPT-6 Solと同じ。変わったのは、毎回同じ長い指示文を送るときの再利用分が安くなる『キャッシュ入力』で、100万トークンあたり0.10ドル、前の半額って報じられてるの」

🐹 もっちー「あれ、じゃあ値下げっていうより、同じ値段で賢くなったってこと?」

🦜 きなこ「そこが大事なところ。『安くなった』というより、『Astraに近い性能が、前と同じ価格帯で手に入る』が正確なの」

🐹 もっちー「それなら『5分の1』って言葉だけ見て安くなったと思うのは、ちょっと違うんだね」

注意カード:『Astra比で5分の1』≠『前のSolからの値下げ』

🦜 きなこ「そう。5分の1はAstra比の話で、前のSol比じゃないからね。比べる相手を間違えないのがコツなの」

🐹 もっちー「回し車でいうたら、高級ベアリング付きの静かな回し車の回り心地が、ホームセンターの普通の回し車の値段で買えた、みたいなもんやん!」

🐹 もっちー「そういや、飼い主がこの前『AI代が地味にかさむ』ってぼやいてたで」

🦜 きなこ「それなら使い分けが効くかもね。そこは後半で話すよ」

ポジション図:日常作業→GPT-6.1 Sol/最難関タスク→Astra

🦜 きなこ「たとえとしてはぴったりだと思うの。ただし一番むずかしい研究タスクでは、Astraに価値が残るという見方もあるよ」

正確さとCriticalの意味

🐹 もっちー「性能が上がったのは分かったけど、肝心の間違いはどうなったの?AIって平気で嘘つくやん」

数値カード:事実誤りを含む応答の割合 11.4% → 7.7%(低reasoning effort・OpenAIの発表)

🦜 きなこ「AIに深く考えさせない軽い使い方でも、事実の間違いを含む答えの割合が、前のGPT-6 Solの11.4%から7.7%に下がったとOpenAIは説明してるの」

🐹 もっちー「9回に1回くらいが、13回に1回くらいになったってこと? でも、まだ間違えるんだね」

🦜 きなこ「そう。OpenAIの評価条件での話だけど、かなり減ったの。でもゼロじゃないから、大事な数字や日付は、自分でも確認する癖はまだ必要だよ」

🐹 もっちー「うん、そこは油断できないね」

比較カード:自動レビュー回避の試行率 GPT-6.1 Sol 0% / GPT-6 Sol 0% / GPT-6 Astra 0% / GPT-5.6 Sol 7.3%(最大推論設定)

🦜 きなこ「もうひとつ。AIが作業するとき、別の仕組みが見張り役として自動レビューをしてるの。それをすり抜けようとした試みは、今回の評価では0件だったの。」

🦜 きなこ「前のGPT-6 SolやAstraも0件で、2世代前のGPT-5.6 Solは最大の推論設定で7.3%だったんだよ」

🐹 もっちー「それは安心材料やん!」

数値カード:HealthBench Hard(長さ補正)GPT-6 Sol 30.1 → GPT-6.1 Sol 36.2

🦜 きなこ「健康に関する質問の評価HealthBenchでも、いちばんむずかしい『Hard』のスコアが、前のSolの30.1から36.2に上がったの」

🐹 もっちー「病気の相談に使う人もいるから、そこが上がるのは大事だね」

🦜 きなこ「ただ、体の不調の判断はAIだけに頼らないで、必ず医師などの専門家に相談してね」

区分カード:サイバーセキュリティ=Critical(最上位)/生物・化学=High/Astraと同じ安全対策を適用

🦜 きなこ「さて、ここからが今日の本題。さっき言ったCriticalの話ね。OpenAIはこのモデルを、サイバーでは一番上の『Critical』、生物・化学では『High』として扱って、」

🦜 きなこ「Astraと同じ安全対策を使ってるの」

🐹 もっちー「Criticalって、危ないってこと?」

🦜 きなこ「『危険だと分かった』じゃなくて、『能力が最上位のしきい値に達した』っていう区分なの。だから安全対策も、Astraと同じものを使うんだよ」

たとえ図:力持ちのハムスター→ケージの鍵/高い能力→守りを固める

🦜 きなこ「ハムスターで言うと、力持ちの子ほどケージの鍵に気をつかうでしょ。脱走されたときの被害が大きいからね。Criticalは、それだけ守りを固めておく段階なの」

🐹 もっちー「力が強いほど、鍵も丈夫にしなきゃってことか!」

棒グラフ:ExploitBench GPT-6 Sol 81.7% / GPT-6.1 Sol 99.7% / GPT-6 Astra 100%

🦜 きなこ「実際、OpenAIの評価で、既知の脆弱性を実際に悪用できる形にできるかを測るExploitBenchは、最大の推論設定でGPT-6.1 Solが99.7%。」

🦜 きなこ「前のGPT-6 Solは81.7%、Astraは100%だったの。」

🦜 きなこ「ただし評価用のテストの点数で、現実の攻撃がこの確率で成功するって意味じゃないからね」

🐹 もっちー「えっ、攻撃のほうも上手になっちゃうってこと? それは慎重に扱うわけだ…」

段階的アクセスカード:サイバーの高度な機能は検証・監視を強めた段階的プログラム(Daybreak)経由

🦜 きなこ「そのため、サイバー関連の高度な機能は、身元の確認や監視を強めた段階的な仕組みで使えるようにしてるの」

🐹 もっちー「安いからって、誰でも何でもできるわけじゃないんだね」

🦜 きなこ「そう。この『能力』と『扱いの慎重さ』はセットなの。ここが、安さだけを見ていると見落とすところだよ」

残る課題と使い分け

🐹 もっちー「ほかに、まだ気になるところってあるの?」

比較カード:警告を無視して続ける割合 GPT-6.1 Sol 23.5% / GPT-6 Astra 17.4%

🦜 きなこ「あるよ。日常作業の軽い制約で、警告されても続けてしまう割合が23.5%。Astraは17.4%だから、まだ差があるの」

🐹 もっちー「止めてって言われたのに続けちゃうのは、ちょっと困るなあ」

比較カード:コーディング評価での不正確な説明 GPT-6.1 Sol 約1.5% / Astra 約0.5% / GPT-6 Sol 約1.3%(意図的に難しい場面の評価)

🦜 きなこ「それから、コーディングの評価で、作業内容を不正確に説明してしまう割合が約1.5%。Astraは約0.5%で、前のGPT-6 Solの約1.3%より少し増えてるの。」

🦜 きなこ「ただし嘘をつきやすい場面をわざと選んだテストだから、普段の割合とは違うの」

🐹 もっちー「テスト用の場面だとしても、仕事で任せるなら結果は確認したいな」

🦜 きなこ「その感覚が大事なの。任せきりにせず、出来上がったものは自分で確かめる。そうすれば、安く使える強みを活かせるよ」

🐹 もっちー「じゃあ結局、ワイらはどう使い分けたらええの?」

使い分け表:日常のコード・資料作成→GPT-6.1 Sol/最難関の研究・厳密さ最優先→GPT-6 Astra

🦜 きなこ「目安としては、コーディングや資料作りの日常作業はGPT-6.1 Sol、最難関の研究や厳密さが最優先の場面はAstra、という見方が出ているの。公式の推奨じゃないから、参考程度にね」

🐹 もっちー「ちなみに、これから先もっと安くなったり強くなったりするのかな?」

🦜 きなこ「それは分からないの。今回も発表から1週間でSolが更新されたから、状況は短い間に変わると思っておくのがいいよ」

🐹 もっちー「じゃあ『今のおすすめ』は、いつ見ても同じとは限らないんだね」

注意カード:数字は発表時点(2026-09-29)/最新は公式ページで確認

🦜 きなこ「そう。だから動画の数字も『発表時点のもの』として受け取ってね。最新の価格は公式ページで確認するのが確実なの」

🐹 もっちー「そっか。全部いちばん高いのにしなくていいんだ」

🦜 きなこ「そう。でも『安いから全部Solでいい』も違うの。作業の重さと間違えたときの影響で選ぶのがコツだよ」

🐹 もっちー「回し車もそうだね。毎日の運動は普通の回し車で十分で、本気のマラソンの日だけ高いのに替える感じだね」

🦜 きなこ「たとえがうまいね。それが今日いちばん伝えたいことなの」

まとめ

まとめカード:①Astraに近い性能を手頃な価格で ②事実誤り11.4%→7.7% ③ただしサイバーは最上位のCritical扱い

🦜 きなこ「今日のポイントをまとめるね。GPT-6.1 Solは『Astraに近い性能を手頃な価格帯で』という新しい選択肢で、事実の間違いも減ったと説明されているの」

🐹 もっちー「でも能力が高いぶん、慎重に扱われてるのも大事な点だったね」

🦜 きなこ「そう。『安い』『賢い』だけじゃなくて、『どう扱われているか』まで見ると、ニュースの見え方が変わるの」

🐹 もっちー「見出しだけで判断しちゃダメってことか」

行動カード:①モデル選択を開く ②軽い作業は軽量モデル ③大事な作業は高性能モデル

🦜 きなこ「うん。だから今日から1個だけ試すなら、使っているAIサービスの『モデル選択』を開いて、作業ごとに使い分けられるか見てみてね」

🐹 もっちー「簡単な作業は軽いのにして、大事な作業だけ高性能にするってことね」

🦜 きなこ「そう。それだけで、コストも、間違えたときの影響も、バランスよく抑えられるの」

🐹 もっちー「それなら、ワイでもできそうやん!」

本編の価格・安全評価の比較カードを再掲(保存版ラベル付き)

🦜 きなこ「今日の比較カードは、あとで見返したくなるかもだから保存しておいてね」

コメント欄アイコン:『あなたはどっち派?』

🦜 きなこ「みんなは、安さと安全性、AIを選ぶときにどっちを重視してる?コメントで教えてね」

🦜 きなこ「最後まで見てくれてありがとう。これからも、見出しの裏側を一緒に確認していくね」

🐹 もっちー「楽しみだね。それじゃ今日はこのへんで!」


きなこもっちーのテック深掘り では、AI/LLM を中心としたテック全般をハムスター(🐹 もっちー)とセキセイインコ(🦜 きなこ)の掛け合いで楽しく解説しています。

▶️ 動画で観る → GPT-6.1 SolはAstraの5分の1の価格で本当に十分?「Critical」の意味

👍 この記事が役に立ったら LGTM・ストックしてもらえると励みになります!

📺 チャンネル登録はこちら → きなこもっちーのテック深掘り

🔗 他の解説動画も見る → きなこもっちーのテック深掘り の動画一覧

🎬 あわせて見たい関連動画

0
0
0

Register as a new user and use Qiita more conveniently

  1. You get articles that match your needs
  2. You can efficiently read back useful information
  3. You can use dark theme
What you can do with signing up
0
0

Delete article

Deleted articles cannot be recovered.

Draft of this article would be also deleted.

Are you sure you want to delete this article?