GPT-6 Sol と GPT-6 Luna が Smart AIPI で提供開始 — 75%オフ、5.6ファミリーの半額
OpenAI は GPT-6 ファミリーを拡張し、コスト効率に最適化された Astra 世代のインテリジェンスを、GPT-5.6 Sol と Luna の半額で提供する GPT-6 Sol と GPT-6 Luna を発表しました。どちらも本日 Smart AIPI で利用可能です。gpt-6-sol は 1M トークンあたり $0.50 / $0.05 / $2.50、gpt-6-luna は $0.025 / $0.0025 / $0.125 で、OpenAI の定価より 75% 安価です。実際のベンチマーク、料金の計算、どちらを使うべきかを紹介します。
要約: gpt-6-sol と gpt-6-luna は本日 Smart AIPI で提供開始されました。Sol は 1M トークンあたり $0.50 / $0.05 / $2.50、Luna は $0.025 / $0.0025 / $0.125 で、OpenAI の定価より 75% 安価です。GPT-6 Astra のトレーニングを、より高速で大幅に低価格なモデルに引き継いでいます。Sol は AutomationBench で Claude Opus 5 を上回り、タスクあたりのコストは約 9%。Luna は DeepSWE で最先端モデルに 1ポイント以内まで迫り、コストは 90%以上低くなっています。以下では、実際の数値と、どちらを使うべきかを紹介します。
今月初め、OpenAI は最も高い知性とアラインメントを備えたモデル、GPT-6 Astra を発表しました。最も要求の厳しいプロジェクトでは、今も Astra の深い能力が必要です。しかし、実際の作業にはさまざまな規模、リズム、予算があります。そこで OpenAI は GPT-6 ファミリーを GPT-6 Sol と GPT-6 Luna で拡張しました。どちらも現在 Smart AIPI で、OpenAI の価格の 4 分の 1 で利用できます。
これらのモデルは Astra と類似した手法でトレーニングされ、プロフェッショナルな作業、正確性、コーディング、コンピューター操作、アラインメントにおける進歩を、より高速で手頃な価格帯に引き継いでいます。GPT-6 ファミリーはコストと知性の曲線全体で優位に立っており、OpenAI は Sol と Luna の API 価格をGPT-5.6 のプロモーション価格から 50% 引き下げることで、効率化の成果を還元しました。Smart AIPI はそこからさらに独自の 75% 割引を適用します。
開発者にとって重要な結果
Sol と Luna はコストと知性のフロンティアに合わせて調整されています。そのため、以下の各スコアはコストと併せて見る価値があります。
| ベンチマーク(最善努力) | GPT-6 Sol | GPT-6 Luna | Claude Opus 5 |
|---|---|---|---|
| DeepSWE v1.1 | 68.8% | 66.6% | — |
| Agents' Last Exam | 56.4% | — | < 56.4% |
| AutomationBench | 33.2% | — | 26.9% |
| OSWorld 2.0(オフライン、コンピューター操作) | 60.5% | — | 60.3% |
スコアが伝えるのは半分だけです。もう半分は、そのスコアを達成するためにかかるコストです。
プロフェッショナルな作業
AutomationBench(営業、マーケティング、オペレーション、サポート、財務、人事にまたがる 47 ツールを使ったエンドツーエンドのビジネスワークフロー)では、xhigh 努力設定の GPT-6 Sol がタスクあたり $0.27 で 33.2%を達成します。これは、最大努力設定の Claude Opus 5(26.9%)を上回り、タスクあたりのコストは Opus 5 の約 9%です。さらに、低努力設定の GPT-6 Astra(30.3%)さえ上回ります。高努力設定では、GPT-6 Luna は前世代モデルをタスクあたりのコストを 58% 下げながら 5.4 パーセントポイント改善します。Agents' Last Exam では、最大努力設定の Sol が 56.4% を記録し、評価における Claude Opus 5 の最高スコアを上回り、タスクあたりのコストは 60% 低くなっています。
コーディング
DeepSWE v1.1(実際のコードベースで行う、オリジナルの長期ソフトウェアエンジニアリングタスク)では、最大努力設定の GPT-6 Sol が 68.8% を記録します。これは評価における Claude Fable 5 の最高スコア(xhigh で 69.9%)から 1.1 ポイント以内で、タスクあたりのコストは約 80% 低くなっています。最大努力設定の GPT-6 Luna は 66.6% を記録し、中努力設定の Claude Opus 5 および Fable 5 に匹敵します。一方、タスクあたりのコストは Opus 5 より 93%、Fable 5 より 96%低くなっています。正確性だけでなくマージ可能性(テスト品質、スコープ管理、コードスタイル)も評価する FrontierCode では、Sol は GPT-5.6 Sol から大幅に改善し、はるかに低いコストで Claude Fable 5.1 xhigh に匹敵します。
コンピューター操作
Astra はコンピューター操作において世界最高のモデルであり続けていますが、Sol と Luna は前世代モデルよりはるかにコスト効率に優れています。OSWorld 2.0 offline では、xhigh 設定の GPT-6 Sol が 60.5% に達し、中努力設定の Claude Opus 5(60.3%)に匹敵しながら、タスクあたりのコストは約 80%低くなっています。最大努力設定の GPT-6 Luna は、中努力設定の GPT-5.6 Sol を、そのコストの 10 分の 1 で上回ります。
正確性とアラインメント
ユーザーが誤りを指摘した匿名化済みの実際の会話から構成された OpenAI 内部の正確性評価では、GPT-6 Sol の誤りはGPT-5.6 Sol の約半分であり、大幅に低いコストで Astra に近い信頼性を実現しています。Luna も大幅に改善しています。どちらも Astra で導入されたアラインメントの取り組みを引き継ぎ、GPT-5.6 の対応モデルを上回っています。自身のコーディング作業について誤解を招く主張をする割合も低下しています。
料金: 75%オフ、同じモデル、同じ API
Smart AIPI の料金は OpenAI の定価の 25% です。両モデルの計算方法は以下のとおりです。
| gpt-6-sol、1M トークンあたり | OpenAI 直接 | Smart AIPI | 節約額 |
|---|---|---|---|
| 入力 | $2.00 | $0.50 | 75% |
| キャッシュ入力 | $0.20 | $0.05 | 75% |
| 出力 | $10.00 | $2.50 | 75% |
| gpt-6-luna、1M トークンあたり | OpenAI 直接 | Smart AIPI | 節約額 |
|---|---|---|---|
| 入力 | $0.10 | $0.025 | 75% |
| キャッシュ入力 | $0.01 | $0.0025 | 75% |
| 出力 | $0.50 | $0.125 | 75% |
両モデルは GPT-6 の改善されたプロンプトキャッシュも継承しています。デフォルトのキャッシュヒット率が高く、キャッシュ入力の読み取りが 90% 割引になるため、コンテキストを再利用するエージェントや長い会話では、さらに低コストになります。同じ重み、同じ OpenAI 互換 API 形式、同じツールを利用できます。違いは請求書だけです。
より洗練された協働スタイル
Sol と Luna は Astra の改善されたコミュニケーションスタイルを継承しています。これは特に技術やコーディングに関する会話で顕著です。より明快で、専門用語が少なく、不自然な言い回しが少なく、価値の低い詳細も減り、内容を失わずに回答がやや短くなっています。実際には、性急に結論へ飛びつかず、何を確認し、何を確認していないかをより率直に伝え、明らかなことを繰り返すためのトークンを減らすエージェントを意味します。
GPT-6 Sol と Luna の使い方
Chat Completions API
curl https://api.smartaipi.com/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-sol",
"messages": [{"role": "user", "content": "Refactor this module and add tests"}]
}'
高い推論を使う Responses API
curl https://api.smartaipi.com/v1/responses \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-sol",
"input": "Triage these open issues and open PRs to fix the top three",
"reasoning": {"effort": "high", "summary": "auto"}
}'
Codex CLI、Cursor、Cline、Roo Code、OpenCode、Aider
OPENAI_BASE_URL=https://api.smartaipi.com/v1
OPENAI_API_KEY=sk-your-smart-aipi-key
OPENAI_MODEL=gpt-6-luna
推論の努力設定は low、medium、high、xhigh に対応しています。Sol と Luna は努力設定に応じて大きく性能が変わります。上記の AutomationBench、Agents' Last Exam、OSWorld の結果はすべて高い努力設定でのものです。長期的なエージェント作業には high または xhigh を、処理量を重視する場合は Luna の low または medium をコスト最適なデフォルトとして使用してください。
実際にはどのモデルを使うべきか
- gpt-6-astra — あらゆる面で最高のモデルです。最高の結果と妥協のない体験を求める場合に選んでください。コンピューター操作、ブラウザ自動化、無人での完了が重要な長期リファクタリングに適しています。
- gpt-6-sol — 最先端モデルのコストの一部で難しい作業を処理します。AutomationBench で Claude Opus 5 をコスト約 9% で上回り、DeepSWE では約 80%低いコストで Fable 5 に 1ポイント以内まで迫ります。大量のエージェントコーディングやビジネス自動化に適したデフォルトです。
- gpt-6-luna — 高速で低価格な層です。最先端に近い DeepSWE スコアを、Opus/Fable より 90%以上低いコストで実現します。大量処理、分類、要約、高スループットのパイプラインに最適です。
3 つすべてが同じエンドポイントと同じキーで動作します。切り替えは 1 行の変更で済むため、誰かのグラフ(このグラフを含む)を信じるのではなく、あなたのワークロードでベンチマークしてください。
始める
無料クレジット付き。新規アカウントには $5 の無料クレジットが付与されます。smartaipi.com/signup で登録し、API キーを作成して、すぐに gpt-6-sol と gpt-6-luna を使い始めてください。クレジットカードは不要です。
- smartaipi.com/signup で登録(無料クレジット、クレジットカード不要)
- ダッシュボードでAPI キーを作成
- ベース URL を
https://api.smartaipi.com/v1に設定 gpt-6-solまたはgpt-6-lunaのモデルを使用
コストに合わせて調整された Astra 世代のインテリジェンスを、定価の 4 分の 1 で本番環境に。