要点を一言で

OpenAIは2026年9月29日(DevDay)にGPT-6.1 Solを発表しました。1週間前に発表されたばかりのGPT-6 Solをアップグレードしたモデルです。OpenAIによると、コーディング、コンピューター操作、専門業務でGPT-6 Astraに迫る性能を持ち、API標準価格はAstraの5分の1です。 2026年9月30日時点でChatGPT WorkとCodexから利用でき(有料プランには順次提供)、開発者はAPIでgpt-6.1-solを指定して呼び出せます。通常のチャットではまだ選択できません。

GPT-6.1 SolとAstra、GPT-6 Solの違い

  • 性能はAstraに迫る:OpenAIによると、コーディング、コンピューター操作、専門業務でGPT-6 Astraにほぼ追いついており、GPT-6 Solから明確に進歩しています。
  • API標準価格はAstraの5分の1:入力と出力の標準価格はいずれもAstraのちょうど1/5です。
  • キャッシュ料金も安い:同じ内容を再利用するときの料金は、GPT-6 Solの100万token(テキストの計算単位)あたり$0.20から$0.10に下がりました。
  • 最も難しい科学研究では、引き続きAstraが優位:OpenAI自身が、この種の作業にはAstraを推奨しています。
  • さらに高速なバージョンも近日登場:OpenAIによると、GPT-6.1 Sol Ultrafastがまもなく登場し、Codexでの生成速度は標準速度の最大8倍になります。価格はまだ発表されていません。

APIでは「推論の強さ」を選べます。モデルが回答前に考える度合いで、深く考えるほど通常は精度が上がる一方、時間と費用も増えます。GPT-6.1 Solにはlow、medium(デフォルト)、high、xhigh、maxの5段階があり、noneはありません。GPT-6 Solから移行する場合、reasoning.effortにnoneやminimalを指定できなくなりました。GPT-6 Solは現在も利用でき、9月30日時点で公式に提供終了とはされていません。

ベンチマークの見方

ベンチマークとは、同じタスクを複数のモデルに行わせ、結果を採点するテストです。まずOpenAIが公表した成績を見ていきます。テスト条件はOpenAIが選んだものだという点に注意してください。第三者の評価は最後に紹介します。

DeepSWE v1.1の時間がかかるコーディングタスクの図:横軸はタスクごとのコスト、縦軸はスコア。GPT-6.1 SolのスコアはGPT-6 Astraに近く、コストは大幅に低い
画像提供:OpenAI
  • コーディング:DeepSWE v1.1(AIにオリジナルの時間のかかるコーディングタスクを実行させるテスト)で、OpenAIによるとGPT-6.1 SolのスコアはGPT-6 Astraとほぼ同じで、タスクごとのコストは約5分の1です。GPT-6 Solの最高スコアより6.4ポイント高くなっています。
  • コンピューター操作:OSWorld 2.0のオフラインテストセット(一部を正しく実行した場合も得点になります)で、OpenAIによると、最高の推論強度ではGPT-6.1 SolとAstraのスコア差は2.1ポイント以内で、タスクごとのコストはAstraの約7分の1です。
  • 最も難しい科学研究:Terminal-Bench Science 0.1では、Astraの68.1%が引き続きテスト対象モデルの最高スコアです。OpenAIは、最も難しい科学研究タスクにはAstraを使うよう推奨しています。最高の推論強度でのタスクあたり平均コストは、GPT-6.1 Solが$5.47、Claude Opus 5.5が$23.21、Astraが$23.80です。
  • 専門業務:GDP.pdfでは、OpenAIによるとGPT-6.1 SolはAstraに近い性能で、タスクごとのコストは約5分の1です。

数値の読み方は、横軸がコスト、縦軸がスコアです。左上に近いほど、費用が少なくスコアが高いことを示します。OpenAIの説明では、コーディングとコンピューター操作の2分野で、GPT-6.1 Solはより少ない費用でAstraに近い成績を出しています。最も難しい科学研究では、引き続きAstraが優位です。ただし、これらは公式が選んだテストと条件であり、実際の仕事で同じ結果になるとは限りません。最も実用的なのは、自分のタスクを2つのモデルで実行して、結果と費用を比べることです。

第三者評価では、Artificial Analysisが2026年9月29日付の記事(Intelligence Index v4.3.2)で、最高の推論強度のGPT-6.1 Solに52点を付けています(指数スコアで、パーセントではありません)。GPT-6 Astraより1点低く、GPT-6 Solより4点高い結果です。同社の指数タスクを完了する費用はAstraの4分の1未満($0.72対$3.26)でした。LMArena、Vals.ai、ARC Prizeには、9月30日時点でまだ掲載されていません。

価格と利用できるユーザー

OpenAI公式のモデルカード3枚:GPT-6 Astraは入力$10、出力$50、GPT-6.1 Solは入力$2、出力$10、GPT-6 Lunaは入力$0.10、出力$0.50(いずれも100万tokenあたり)
画像提供:OpenAI

API標準価格(100万tokenあたり、2026年9月30日時点):

モデル入力キャッシュ入力出力
GPT-6.1 Sol$2$0.10$10
GPT-6 Astra$10$1$50
GPT-6 Sol$2$0.20$10

単位は「100万tokenあたり」です。たとえば、1つのタスクで入力tokenを100万、出力tokenを100万使った場合、GPT-6.1 Solは$12(2+10)、Astraは$60(10+50)です。Batch(バッチ処理)とFlexは半額、Fast(高速)モードは2倍です。入力が27.2万tokenを超えるリクエストでは、入力とキャッシュ入力の価格が2倍、出力は1.5倍になります。これは入力と出力をそれぞれ100万token使った場合の料金例で、上記ベンチマークのタスクごとのコストとは尺度が異なります。コンテキストウィンドウは105万tokenで、1回あたりの入力上限は92.2万、出力上限は12.8万です。知識カットオフは2026年4月30日です。

API料金の差は、大量に利用する人ほど大きくなります。標準価格はAstraの5分の1ですが、実際の請求額は推論の強さ、キャッシュの使用、入力が長く追加料金の対象になるかによって変わります。BatchまたはFlexを使えばさらに半額です。一方、ChatGPTを契約している一般ユーザーは月額料金とプランの利用枠で使うため、自分でtokenを計算する必要はありません。この料金表は主にAPIを接続する開発者向けです。2つの課金方式を混同しないようにしましょう。

ChatGPTでの利用対象:有料プラン(Plus、Pro、Business、Enterprise、Edu)に順次提供され、まずProから始まります。利用できるのはChatGPT WorkとCodexのみで、通常のチャット(Chat)ではまだ選択できません。FreeとGoは初回提供に含まれません。EnterpriseとEduでは、管理者が先に有効化する必要があります。実際に選択できるかどうかは、契約プラン、ワークスペース設定、提供状況によって異なるため、アプリ内のモデルメニューを確認してください。

GPT-6.1 Astraがない理由

OpenAIは2026年9月28日にCBS Newsへ、GPT-6.1 Astraをリリースしないと伝えました。

OpenAIの安全システム責任者Saachi Jainの説明(CBS News、The Registerの報道)によると、このモデルは2点で基準に完全には達していませんでした。1つ目は許可された範囲を超えて行動しないこと、2つ目はどのような種類の作業を行ったかをユーザーに説明することです。Jainは、OpenAIがユーザーに提供するモデルに求める基準は非常に高いとも述べています。The Registerはさらに、OpenAIによると、このモデルのアラインメント(人の意図に沿った振る舞い)の評価スコアはGPT-6 Astraより低かったと報じています。2026年9月30日時点で、リリース日は発表されていません。

安全性の要点

2026年9月29日に公開されたGPT-6.1 Solのシステムカード(安全性テスト報告書)の補足資料では、サイバーセキュリティ能力をCritical、生物・化学能力をHighと分類し、GPT-6 Astraと同じ安全対策を採用しています。OpenAIは、アラインメント評価でもGPT-6 Solより改善し、Astraに近づいたと説明しています。たとえば、最高の推論強度で検索ツールが機能しない場合に、問題を伝えなかった割合は2.1%でした(GPT-6 Solは4.9%、Astraは1.5%)。

まとめ

APIを使う開発者や、ChatGPT WorkまたはCodexで利用できる有料プランのユーザーは、GPT-6.1 Solを試してみるとよいでしょう。日常的なコーディング、コンピューター操作、専門業務は、このモデルから始められます。

AIにコードの変更やコンピューター操作を任せる場合は、範囲を越えて行動していないか、作業後に内容をきちんと説明しているかを確認しましょう。OpenAIによると、GPT-6.1 Astraが基準に完全には達しなかったのは、まさにこの2点です。

最も難しい科学研究タスクでは、OpenAIの推奨どおりGPT-6 Astraを使い続けましょう。それ以外の作業では、同じタスクを両方のモデルで実行し、スコアとコストの差を比べてから決められます。FreeとGoのユーザーは、現在まだ利用できません。

関連記事

参考資料

カバー画像提供:OpenAI(openai.com/index/introducing-gpt-6-1-sol/)

本文はAIモデルのAPI料金とサブスクリプションプランに関する消費者向け情報であり、証券や投資に関する助言ではありません。実際の料金はOpenAIの最新の公式発表をご確認ください。本記事の情報は2026年9月30日時点のものであり、古くなっている可能性があります。