【速報】GPT-6.1 Solが登場 知能はAstra並みで価格は約5分の1【OpenAI DevDay 2026】【OpenAI Codex】
概要
OpenAIがGPT-6.1 Solを発表しました。最上位のGPT-6 Astraに匹敵する知能を、約1/5の価格で利用できるとされています。コーディング、専門文書の理解、複数ステップの業務ワークフロー、コンピューター操作などでGPT-6 Solから大きく性能が向上しており、コスト効率を重視する開発者や業務利用者に向けたモデルです。
主なポイント
- GPT-6.1 SolはGPT-6 Astra並みの知能を約1/5の価格で実現し、OpenAIは「現在入手可能なモデルの中で知能に対して最もコスト効率が高い」と位置づけている。総合能力ではAstraが引き続きフロンティアモデル。
- キャッシュ入力は100万トークンあたり0.1ドル。標準入力価格より95%安く、GPT-6 Solのキャッシュ入力価格よりも50%安い。
- コード生成やデバッグ、文書理解、複数ステップの業務ワークフロー実行など、専門業務全般でGPT-6 Solから大幅に向上している。
- 図表や小さな文字を含む複雑なPDFへの専門的質問のベンチマークでは、Anthropic社のOpus 5.5を上回るスコアを、タスクあたり半分未満のコストで達成したとされる。Astraの性能にも1/5のコストで迫る。
- 複数ステップの業務自動化を測るAutomationBenchでは、思考量「中」で約1/3のコストでOpus 5.5を2.2ポイント、GPT-6 Solを4.8ポイント上回った。
- コンピューター操作のベンチマークでは、思考量「最大」で約半分のコストでGPT-6 Solを7ポイント上回り、タスクあたり1/7のコストでAstraとの差を2.1ポイントまで縮めた。
- 事実誤り(ハルシネーション)率が低下し、安全性評価でもGPT-6 Solより失敗率が低く、Astraに近づいた。安全性の自動レビューを回避する試みは観測されなかった。
- 日本時間9月30日から、Plus・Pro・Business・Enterpriseの全ユーザーがChatGPTのWorkとCodexで利用可能。チャットではまだ使えない。開発者はAPIでも利用できる。
- 動画内のベンチマーク数値は、OpenAI自身の発表と動画での読み上げに基づく。他社モデルとの比較は自社評価であり、鵜呑みにせず自分の業務で検証する必要がある。
実践に使えること
- 現在Astraを使っている開発や業務で、Solに切り替えた場合の品質とコストを同じタスクで比較する。
- APIで大量処理をする場合は、キャッシュ入力(100万トークンあたり0.1ドル)を活用できるよう、共通プロンプトを固定する設計にしてコストを下げる。
- PDF資料の質疑応答、複数ステップの業務自動化、PC操作エージェントなど、動画でスコアが示された用途から試す。
- CodexやChatGPT Workでモデル選択に6.1 Solが出ているか確認する。動画では、日本での提供は1〜2日遅れる可能性があるとされている。
- 思考量(低・中・最大)を使い分け、通常業務は中、難しいタスクだけ最大にしてコストと精度のバランスを取る。