GPT-6.1 Sol が Smart AIPI で提供開始 — Astra に迫る知能を 5 分の 1 の価格で
OpenAI の GPT-6.1 Sol は GPT-6 Sol を強化し、エージェント型コーディング、コンピューター操作、プロフェッショナル業務において GPT-6 Astra にほぼ匹敵します — Astra のトークン価格の 5 分の 1 で。Smart AIPI では本日より $0.50 / $0.025 / $2.50 per 1M で提供開始 — OpenAI の $2 / $0.10 / $10 より 75% 低価格です。実際のベンチマークと価格計算を紹介します。
要約: gpt-6.1-sol は本日から Smart AIPI で $0.50 / $0.025 / $2.50 per 1M tokens で利用可能です — OpenAI の $2 / $0.10 / $10 より 75% 低価格です。これは GPT-6 Sol のアップグレードであり、エージェント型コーディング、コンピューター操作、プロフェッショナル業務において GPT-6 Astra にほぼ匹敵しながら、価格はおよそ Astra の 5 分の 1です。以下では、実際のベンチマーク、注意点、そして $0.025/1M のキャッシュ入力がエージェントのコスト計算をどう変えるかを解説します。
OpenAI は、GPT-6 Sol をアップグレードした GPT-6.1 Sol をリリースしました。エージェント型コーディング、コンピューター操作、プロフェッショナル業務において GPT-6 Astra の知能にほぼ匹敵しながら、Astra の標準入力・出力トークン価格の 5 分の 1 です。API では gpt-6.1-sol として利用でき、Smart AIPI では現在 OpenAI の 4 分の 1 の価格で提供しています。
ローンチ記事はマーケティングになりがちです。これはそうではありません — 私たちはこのモデルへのアクセスを提供しているため、どこで優れ、どこでは Astra が依然として優れ、実際にいくらかかるのかを正確にお伝えできます。以下の数値はすべて OpenAI が公開した評価結果に基づいています。
GPT-6.1 Sol のラインナップ内での位置付け
| モデル | 最適な用途 | OpenAI 入力 / 出力 / キャッシュ(per 1M) |
|---|---|---|
| GPT-6 Astra | 最高の知能、最高の結果 | $10 / $50 / $1 |
| GPT-6.1 Sol | Astra に迫る知能、価格は 5 分の 1 | $2 / $10 / $0.10 |
| GPT-6 Luna | 大規模な日常業務を高速かつ効率的に処理 | $0.10 / $0.50 / $0.01 |
Smart AIPI ではこれらの価格の 25% をお支払いいただきます。要点は、GPT-6.1 Sol が複雑なプロフェッショナルタスク — コードの記述とデバッグ、文書理解、複数ステップのビジネスワークフロー実行 — 全般で GPT-6 Sol を大幅に改善しており、複数の評価でコストのごく一部で Astra の性能に迫ることです。
開発者にとって重要な結果
| ベンチマーク | GPT-6.1 Sol の結果 |
|---|---|
| DeepSWE v1.1(コーディング) | コスト約 1/5 で GPT-6 Astra に匹敵。低い推論努力で GPT-6 Sol を +6.4 pts 上回る |
| GDP.pdf(文書 QA) | タスク当たり半額未満でフォールバック付き Opus 5.5 を上回る。コスト約 1/5 で Astra に迫る |
| AutomationBench(ワークフロー) | コスト約 1/3 で Opus 5.5(medium)を +2.2 pts 上回る。GPT-6 Sol を +4.8 pts 上回る |
| OSWorld 2.0 オフライン(コンピューター操作) | コスト半額未満で GPT-6 Sol を +7 pts 上回る。コスト約 1/7 で Astra との差は 2.1 pts |
| Terminal-Bench Science 0.1 | GPT-6 Sol の 2× 超。$5.47/task vs $23.21 (Opus 5.5) / $23.80 (Astra) |
| 事実性(難しいプロンプト、低努力) | エラー率が 11.4% → 7.7%(約 32% 減少)。Astra との差は 1.9 pts 以内 |
コーディング
実際のコードベースにおける複雑なソフトウェアエンジニアリングタスクを評価する DeepSWE v1.1 で、GPT-6.1 Sol はコスト約 5 分の 1 で GPT-6 Astra に匹敵し、低い推論努力とコストで GPT-6 Sol の最高スコアを 6.4 percentage points 上回ります。より優秀で、かつ実行コストも低いという、希少なアップグレードです。
プロフェッショナル業務
GDP.pdf — 金融、医療、法務、その他 7 分野の、複雑な PDF(表、グラフ、図、細則)に関する実際のプロンプト — では、GPT-6.1 Sol はタスク当たり半額未満でフォールバック付き Opus 5.5 より高いスコアを記録し、コスト約 5 分の 1 で Astra の最先端性能に迫ります。AutomationBench(47 のツールにまたがる複数ステップのビジネスワークフロー)では、中程度の推論努力でコスト約 3 分の 1ながら Opus 5.5 を 2.2 points 上回り、同一設定の GPT-6 Sol から 4.8 points 向上しています。
コンピューター操作
OSWorld 2.0 のオフラインセットでは、GPT-6.1 Sol は最大推論努力においてコスト半額未満で GPT-6 Sol を seven percentage points 上回り、タスク当たりコスト約 7 分の 1 で Astra との差は 2.1 points です。Astra は依然として最も強力なコンピューター操作モデルですが、GPT-6.1 Sol は支出のごく一部でそこにかなり近づきます。
科学研究
データ分析、シミュレーション、定理証明を対象とする Terminal-Bench Science 0.1 では、GPT-6.1 Sol は最大努力時にコスト半額未満でGPT-6 Sol のスコアを 2 倍以上に伸ばします。最大努力時の平均コストは $5.47 per task であるのに対し、Opus 5.5 は $23.21、Astra は $23.80 — いずれよりも 75% 超低価格です。Astra は依然として 68.1% でベンチマーク首位を維持しており、最も困難な研究タスクには引き続き最適です。
事実性
エラーを誘発しやすい難しいプロンプトでは、GPT-6.1 Sol の最大の向上は低推論努力時に見られ、事実誤認を含む回答の割合を 11.4% to 7.7% — 約 32% — 削減します。テストした設定全体で、そのエラー率はコスト 5 分の 1 未満ながら Astra との差 1.9 points 以内に収まっています。(これらは意図的に難しいプロンプトであり、事実誤認がより少ない通常の利用状況を反映するものではありません。)
アラインメント: Astra に測定可能なほど接近
GPT-6.1 Sol は、OpenAI のアラインメント評価において GPT-6 Sol から大幅に向上しています — 自身の限界についてより透明性が高く、ユーザーの意図と安全制約を尊重する点でより信頼できます。具体例として、検索ツールが壊れている場合に推測で答えず、そのことを開示する能力を見てみましょう(低いほど良好)。
| モデル | 壊れた検索の未開示率(低いほど良好) |
|---|---|
| GPT-6 Astra | 1.5% |
| GPT-6.1 Sol | 2.1% |
| GPT-6 Sol | 4.9% |
| GPT-6 Luna | 28.7% |
また、自動化された安全性レビュー担当者を回避しようとする試みはありませんでした。これは GPT-6 Astra および GPT-6 Sol と同等です。詳細は OpenAI の GPT-6.1 Sol system card addendum に掲載されています。
キャッシュ入力のポイント
エージェントにとって静かに最も重要な数字は、cached input is $0.10 per 1M であることです。OpenAI の定価では、標準入力より 95% 安く、GPT-6 Sol のキャッシュレートの半額です。Smart AIPI では $0.025 per 1M cached input になります。エージェントが大規模なシステムプロンプト、ツールスキーマ、または文書コンテキストをリクエスト間で再利用する場合、そのコンテキストの再送はほぼ無料です。75% の Smart AIPI 割引と組み合わせることで、GPT-6.1 Sol は高性能でコンテキスト量の多いエージェントを実行する最も安価な方法の一つとなります。
この解説では、キャッシュ読み取り価格が半額になることでコンテキスト量の多いエージェントの経済性がなぜ変わるのかを掘り下げ、今後のデフォルトとして GPT-6.1 Sol を選ぶ理由を説明します。
結論は上記の数値と一致します。キャッシュ読み取りが半額で、Astra に迫る品質を持つ GPT-6.1 Sol は、ほとんどのエージェントワークロードにとって合理的な新たなデフォルトです — 最も困難なタスクでのみ Astra を選んでください。
価格: 75% オフ、同じモデル、同じ API
| gpt-6.1-sol、per 1M tokens | OpenAI 直接利用 | Smart AIPI | 節約額 |
|---|---|---|---|
| 入力 | $2.00 | $0.50 | 75% |
| キャッシュ入力 | $0.10 | $0.025 | 75% |
| 出力 | $10.00 | $2.50 | 75% |
同じ重み、同じ OpenAI 互換 API 形式、同じツールです。違うのは請求書だけです。
GPT-6.1 Sol の使い方
Chat Completions API
curl https://api.smartaipi.com/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6.1-sol",
"messages": [{"role": "user", "content": "Refactor this module and add tests"}]
}'
高推論を使用した Responses API
curl https://api.smartaipi.com/v1/responses \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6.1-sol",
"input": "Triage these open issues and open PRs to fix the top three",
"reasoning": {"effort": "high", "summary": "auto"}
}'
Codex CLI、Cursor、Cline、Roo Code、OpenCode、Aider
OPENAI_BASE_URL=https://api.smartaipi.com/v1
OPENAI_API_KEY=sk-your-smart-aipi-key
OPENAI_MODEL=gpt-6.1-sol
推論努力は low、medium、high、xhigh をサポートしています。GPT-6.1 Sol は努力量に応じて十分にスケールします — 上記の結果のいくつかは最大努力時のものであり、その場合でもタスク当たりのコストは Astra のごく一部です。最大 8x 高速なトークン生成を実現する GPT-6.1 Sol Ultrafast バリアントも登場予定です。
実際にどのモデルを実行すべきか?
- gpt-6-astra — 最も知能の高いモデル。最高の結果と最も困難なタスク向けです。最難関の研究、長期間にわたるコンピューター操作、無人で完了させることが目的となるあらゆる作業に適しています。
- gpt-6.1-sol — Astra に迫る知能を 5 分の 1 の価格で提供。高度なエージェント型コーディング、文書作業、ビジネス自動化、科学業務において、Astra の請求額なしに品質の大部分を求める場合の新たなデフォルトです。
- gpt-6-sol — 依然として強力で、キャッシュがより安価な選択肢です。gpt-6.1-sol は同じ入出力価格で品質面ではこれを上回ります。
- gpt-6-luna — 大規模な日常業務を高速かつ効率的に処理します。バルクタスク、分類、要約、高スループットのパイプラインに適しています。
4 つすべてが同じエンドポイントと同じキーで動作します。切り替えは 1 行の変更なので、誰かのチャート — この記事のものも含めて — を信じるのではなく、あなた自身のワークロードでベンチマークしてください。
始める
無料クレジット付き。すべての新規アカウントに $5 の無料クレジットを提供しています。smartaipi.com/signup で登録し、API キーを作成すれば、すぐに gpt-6.1-sol を使い始められます。クレジットカードは不要です。
- smartaipi.com/signup で登録(無料クレジット、クレジットカード不要)
- ダッシュボードでAPI キーを作成
- ベース URL を
https://api.smartaipi.com/v1に設定 - モデル
gpt-6.1-solを使用
Astra に迫る知能を、本番環境で、5 分の 1 の価格で — さらに Smart AIPI ならその 4 分の 1 で。