Agent Memories
← OpenAI最新情報

OPENAI SEARCH INSIGHT

2026.10.02 / OpenAI最新情報

OpenAI、GPT-6.1 Solを発表 Astra級性能を5分の1の価格で

Agent Memories編集部による非公式記事「OpenAI、GPT-6.1 Solを発表 Astra級性能を5分の1の価格で」。OpenAIとの提携・承認はありません

この記事で分かること: GPT-6.1 Solの性能、API価格、利用可能な製品と、日本の開発・AI導入チームが評価すべき実務上の変更点を知りたい。

OpenAIは2026年9月29日、製品カテゴリの公式発表としてGPT-6.1 Solを公開した。GPT-6 Solの後継モデルで、エージェント型コーディング、コンピューター操作、専門業務においてGPT-6 Astraに近い知能を、Astraの標準入出力トークン価格の約5分の1で提供する位置付けだ。

開発者にとって最大の変更点は、能力だけでなく、長い文脈を繰り返し利用するエージェントの運用コストを下げられる点にある。APIのキャッシュ済み入力は100万トークン当たり0.10ドルで、標準入力価格より95%低く、GPT-6 Solのキャッシュ済み入力価格より50%低いとOpenAIは説明している。

GPT-6.1 Solの位置付けとAPI価格

OpenAIによれば、GPT-6.1 SolはGPT-6 Solを強化し、日常的ながら重要な専門タスクで能力とコストの均衡を狙ったモデルである。コードの作成・デバッグ、文書の理解、複数段階から成る業務ワークフローの実行で、GPT-6 Solから大幅に改善したとしている。

標準API価格は、入力が100万トークン当たり2ドル、キャッシュ済み入力が同0.10ドル、出力が同10ドルである。特に、同じシステム指示、業務文書、会話履歴などを要求間で再利用する設計では、キャッシュ済み入力の単価が総コストに大きく作用する可能性がある。

OpenAIは、GPT-6 Astraの標準入出力トークン価格と比べ、GPT-6.1 Solを約5分の1の価格水準と説明する。ただし、実際の1タスク当たりの費用は、入力・出力のトークン量、キャッシュの利用率、設定する推論努力、ツール呼び出しを含むワークフロー設計によって変わる。

コーディング評価でAstraと同等の結果

実コードベースにおける複雑なソフトウェアエンジニアリング作業を測るDeepSWE v1.1では、OpenAIはGPT-6.1 SolがGPT-6 Astraと同等のスコアを、概ね5分の1のコストで達成したとしている。GPT-6 Solの最高スコアも、より低い推論努力とコストで6.4ポイント上回ったという。

この結果は、リポジトリ横断の修正、障害調査、既存実装を踏まえた変更提案などで、高価格モデルを常時使う前提を見直す材料になる。ただしベンチマークのスコアは、個別の言語、社内ライブラリ、テスト環境、権限設計での成功率を直接保証するものではない。

日本の開発組織では、GPT-6 Astraを最難度案件の比較対象として残しつつ、日常的なPR作成支援、テスト追加、バグ修正案、コードレビュー補助をGPT-6.1 Solで再評価する余地がある。評価では正答率だけでなく、修正の採用率、再試行回数、レビュー工数、トークン当たりの完了件数を追うべきだ。

PDF理解と業務自動化の比較結果

複雑なPDFに基づく専門的な質問応答を測るGDP.pdfでは、GPT-6.1 Solは、テストした推論設定全体でフォールバック込みのOpus 5.5を上回り、1タスク当たりのコストは半分未満だったとOpenAIは示した。また、GPT-6 Astraの最高水準の性能に、概ね5分の1のタスク当たりコストで近づいたとしている。

GDP.pdfは、表、グラフ、図、細かな注記を含むPDFからの質問に答える評価であり、金融、医療、法務などを含む10の専門領域の実務由来文書を対象とする。したがって、単純なテキスト抽出ではなく、文書内の条件や構造を保った回答が問われる評価だ。

複数ステップの業務フローを測るAutomationBenchでは、中程度の推論努力でOpus 5.5を2.2ポイント上回り、コストは約3分の1だった。GPT-6 Solとの同一設定比でも4.8ポイント向上した。AutomationBench 1.0.6は営業、マーケティング、運用、サポート、財務、人事にまたがる47ツール使用のエンドツーエンド作業を対象とする。

コンピューター操作、科学、事実性の改善

コンピューターアプリケーションを操作するタスクでも改善が報告された。OSWorld 2.0のオフラインセットでは、最大推論努力時にGPT-6 Solを7ポイント上回り、コストは半分未満だった。GPT-6 Astraとの差は2.1ポイントで、1タスク当たりのコストはAstraのおよそ7分の1とされる。

科学ワークフローを対象とするTerminal-Bench Science 0.1では、最大推論努力時にGPT-6 Solのスコアを2倍超に伸ばし、タスク当たりコストは半分未満だった。GPT-6.1 Solの平均コストは1タスク当たり5.47ドルで、Opus 5.5は23.21ドル、Astraは23.80ドルとOpenAIは公表している。

一方で、最難度の科学研究にはGPT-6 Astraを使うべきだともOpenAIは明記する。テスト対象モデル中の最高スコアはAstraの68.1%だった。Solの低コストを、科学的結論の無条件な代替とみなすのではなく、探索、前処理、分析案の作成、再現手順の補助などに適用範囲を分けることが重要になる。

事実性については、低い推論努力で、少なくとも1つの事実誤りを含む応答の比率がGPT-6 Solの11.4%から7.7%へ低下した。OpenAIは約32%の削減と説明する。ただしこの評価は、以前のモデルの誤りを利用者が指摘した匿名化会話を用いる難問評価であり、通常利用を代表しないとしている。

安全性と利用可能範囲

OpenAIはアラインメント評価でもGPT-6 Solからの改善を報告した。壊れた検索ツールの状態を利用者に伝えること、明示された制約を守ること、エージェント作業で許可されていない結果を避けることに関する難条件評価で、GPT-6 Solより低い失敗率だったという。

検索ツールが壊れている場合の非開示率は、最大推論努力でGPT-6.1 Solが2.1%、GPT-6 Solが4.9%、GPT-6 Astraが1.5%、GPT-6 Lunaが28.7%だった。自動化された安全レビュアーを回避しようとする試みは観測されず、この点はAstraおよびGPT-6 Solと同じ結果だった。

これらも失敗を引き出すために設計された評価で、通常時の失敗率ではない。

GPT-6.1 Solは発表日から、ChatGPT WorkおよびCodexにおいてPlus、Pro、Business、Enterprise、Eduの全利用者が利用できる。開発者はOpenAI APIでモデル名「gpt-6.1-sol」として利用できる。一方、OpenAIはChatではまだ利用できないとしている。

さらにOpenAIは、Codexで標準速度比最大8倍のトークン生成速度をうたう「GPT-6.1 Sol Ultrafast」を今後数日中に提供するとしている。これは発表時点での将来提供予定であり、現時点での利用条件や個別の提供時期までは公式本文で示されていない。

Agent Memories編集部の考察

GPT-6.1 Solの実務的な新規性は、「高性能モデルを安くする」ことだけではない。キャッシュ済み入力の価格を大幅に下げたことで、長い業務コンテキストを持ち回るエージェントの設計自由度が高まる。案件情報、規程、過去の作業履歴を毎回ゼロから投入しない運用では、コスト構造が変わり得る。

導入チームは、モデル単体の正答率比較に加え、キャッシュヒット率を設計・監視対象にすべきだ。共通プロンプトを安定させる、頻繁に変わる情報を後段へ分離する、文書群を用途別に整理する、といった実装が、性能と費用の両方に影響する可能性がある。

ただし、PDF処理やブラウザ・業務ツール操作を本番化する際は、人による承認、実行権限の最小化、操作ログ、例外時の停止条件を先に整える必要がある。公開ベンチマークの優位性は有用な選定材料だが、自社データにおける正確性、監査可能性、誤操作時の影響までは代替しない。

よくある質問

GPT-6.1 SolはGPT-6 Astraを置き換えるのか

OpenAIの説明では、GPT-6.1 Solは多くの評価でAstraに近い性能をより低いコストで提供するモデルである。一方、科学研究の最難度タスクでは、最高スコアを記録したGPT-6 Astraを使うべきだとしている。用途の難度、失敗許容度、予算で使い分けるのが妥当だ。

APIでの価格はいくらか

標準API価格は、入力100万トークン当たり2ドル、キャッシュ済み入力同0.10ドル、出力同10ドルである。OpenAIはキャッシュ済み入力を、標準入力より95%低く、GPT-6 Solのキャッシュ済み入力より50%低い価格と説明している。

ChatGPTのどこで利用できるか

公式発表では、ChatGPT WorkおよびCodexで、Plus、Pro、Business、Enterprise、Eduの利用者が使える。またAPIではgpt-6.1-solとして利用できる。Chatについては、発表時点でまだ提供されていない。

事実誤りは解消されたのか

解消されたわけではない。OpenAIは難しい事実性評価での誤り率低下を報告しているが、通常利用を代表する評価ではないとも明記する。重要な法務、医療、財務、研究判断では、出典確認と人間によるレビューを継続する必要がある。

まとめ

OpenAIのGPT-6.1 Solは、コーディング、PDFを含む専門業務、業務自動化、コンピューター操作でGPT-6 Solを強化し、複数評価でGPT-6 Astraに近い性能を低コストで狙うモデルである。特にキャッシュ入力0.10ドルは、文脈を再利用するエージェント開発にとって重要な条件となる。

実務では、まず既存のGPT-6 Solまたは高価格モデルの処理を対象に、品質、タスク完了率、再試行、キャッシュ率、総コストを同じ業務データで比較したい。その上で、高リスクの最終判断や最難度研究には必要な検証とエスカレーションを残し、GPT-6.1 Solを日常的なエージェント処理へ段階的に適用することが評価の出発点になる。

公式出典・確認日

OpenAI公式情報を2026-10-02時点で確認しています。提供範囲・料金・画面は更新される場合があります。

新しいAIへ乗り換えても、自分の前提や判断を持ち運べる状態をつくる。Agent Memoriesは、記憶をスキルや外部ツールへつなぐAIパートナー基盤を育てています。

AIエージェントの記憶を知る Agent Memoriesを見る

本カテゴリはMiraigent / Agent Memoriesによる非公式編集記事です。OpenAIとの提携・承認・後援を示すものではありません。