GPT-6 Sol und GPT-6 Luna sind jetzt auf Smart AIPI verfügbar – 75 % Rabatt, halb so teuer wie die 5.6-Familie
OpenAI hat die GPT-6-Reihe gerade um GPT-6 Sol und GPT-6 Luna erweitert – Astra-Generation-Intelligenz, optimiert auf Kosteneffizienz, zum halben Preis von GPT-5.6 Sol und Luna. Beide sind heute auf Smart AIPI verfügbar: gpt-6-sol für $0.50 / $0.05 / $2.50 pro 1M Tokens und gpt-6-luna für $0.025 / $0.0025 / $0.125 – 75 % unter der OpenAI-Listenpreis. Hier sind die tatsächlichen Benchmarks, die Preisberechnung und welches Modell Sie verwenden sollten.
TL;DR: gpt-6-sol und gpt-6-luna sind heute auf Smart AIPI verfügbar. Sol kostet $0.50 / $0.05 / $2.50 pro 1M Tokens; Luna kostet $0.025 / $0.0025 / $0.125 – 75 % unter dem Listenpreis von OpenAI. Sie übertragen das Training von GPT-6 Astra auf schnellere, deutlich günstigere Modelle: Sol schlägt Claude Opus 5 auf AutomationBench bei ~9 % der Kosten pro Aufgabe, und Luna liegt bei DeepSWE nur einen Punkt hinter Frontier-Modellen, bei Kosten von 90 %+ weniger. Im Folgenden: die tatsächlichen Zahlen und welches Modell Sie ausführen sollten.
Anfang dieses Monats stellte OpenAI GPT-6 Astra vor, sein intelligentestes und am besten ausgerichtetes Modell. Die anspruchsvollsten Projekte benötigen weiterhin Astras volle Tiefe – aber Arbeit findet in unterschiedlichen Größenordnungen, Rhythmen und Budgets statt. Deshalb hat OpenAI die GPT-6-Reihe um GPT-6 Sol und GPT-6 Luna erweitert; beide sind ab sofort auf Smart AIPI zum Viertel des OpenAI-Preises verfügbar.
Diese Modelle wurden mit ähnlichen Methoden wie Astra trainiert und übertragen dessen Fortschritte bei professioneller Arbeit, Faktentreue, Programmierung, Computernutzung und Ausrichtung auf schnellere und erschwinglichere Stufen. Die GPT-6-Familie führt entlang der Kosten-Intelligenz-Kurve, und OpenAI gibt die Effizienzgewinne weiter, indem die API-Preise für Sol und Luna gegenüber der Aktionspreisgestaltung von GPT-5.6 um 50 % gesenkt wurden. Smart AIPI gibt zusätzlich seinen eigenen Rabatt von 75 % weiter.
Die Ergebnisse, die für Entwickler zählen
Sol und Luna sind auf die Kosten-Intelligenz-Grenze abgestimmt. Daher sollte jeder der folgenden Werte zusammen mit seinen Kosten betrachtet werden.
| Benchmark (bestmöglicher Aufwand) | GPT-6 Sol | GPT-6 Luna | Claude Opus 5 |
|---|---|---|---|
| DeepSWE v1.1 | 68.8% | 66.6% | — |
| Agents' Last Exam | 56.4% | — | < 56.4% |
| AutomationBench | 33.2% | — | 26.9% |
| OSWorld 2.0 (offline, Computernutzung) | 60.5% | — | 60.3% |
Die Werte erzählen nur die halbe Geschichte – die andere Hälfte ist, wie viel sie kosten.
Professionelle Arbeit
Auf AutomationBench (End-to-End-Geschäftsabläufe mit 47 Tools aus Vertrieb, Marketing, Betrieb, Support, Finanzen und HR) erreicht GPT-6 Sol bei xhigh-Aufwand 33.2% für $0.27 pro Aufgabe – und übertrifft Claude Opus 5 bei maximalem Aufwand (26.9%) mit ungefähr 9 % der Kosten von Opus 5 pro Aufgabe; sogar GPT-6 Astra bei geringem Aufwand (30.3%) wird geschlagen. Bei hohem Aufwand verbessert sich GPT-6 Luna gegenüber seinem Vorgänger um 5.4 Prozentpunkte bei 58 % niedrigeren Kosten pro Aufgabe. Bei Agents' Last Exam erreicht Sol bei maximalem Aufwand 56.4% und liegt damit über dem höchsten Wert von Claude Opus 5 in der Auswertung – bei 60 % niedrigeren Kosten pro Aufgabe.
Programmierung
Bei DeepSWE v1.1 (ursprüngliche Software-Engineering-Aufgaben mit langem Zeithorizont in echten Codebasen) erreicht GPT-6 Sol bei maximalem Aufwand 68.8% – innerhalb von 1.1 Punkten von Claude Fable 5s bestem Ergebnis in der Auswertung (69.9% bei xhigh) und bei ungefähr 80 % niedrigeren Kosten pro Aufgabe. GPT-6 Luna erreicht bei maximalem Aufwand 66.6%, vergleichbar mit Claude Opus 5 und Fable 5 bei mittlerem Aufwand, kostet pro Aufgabe jedoch 93 % weniger als Opus 5 und 96 % weniger als Fable 5. Bei FrontierCode, das nicht nur die Korrektheit, sondern auch die Zusammenführbarkeit bewertet (Testqualität, Einhaltung des Umfangs, Codestil), verbessert sich Sol deutlich gegenüber GPT-5.6 Sol und erreicht Claude Fable 5.1 xhigh bei deutlich geringeren Kosten.
Computernutzung
Astra bleibt das weltweit beste Modell für die Computernutzung, aber Sol und Luna sind deutlich kosteneffizienter als ihre Vorgänger. Bei OSWorld 2.0 offline erreicht GPT-6 Sol bei xhigh 60.5% – gleichauf mit Claude Opus 5 bei mittlerem Aufwand (60.3%), bei ungefähr 80 % niedrigeren Kosten pro Aufgabe. GPT-6 Luna bei maximalem Aufwand übertrifft GPT-5.6 Sol bei mittlerem Aufwand zu einem Zehntel seiner Kosten.
Faktentreue und Ausrichtung
Bei OpenAIs interner Bewertung der Faktentreue – basierend auf de-identifizierten echten Unterhaltungen, in denen Nutzer Fehler markiert haben – macht GPT-6 Sol etwa halb so viele Fehler wie GPT-5.6 Sol und nähert sich damit der Zuverlässigkeit von Astra bei deutlich geringeren Kosten. Auch Luna verbessert sich deutlich. Beide bauen auf der mit Astra eingeführten Arbeit an der Ausrichtung auf und zeigen Verbesserungen gegenüber ihren GPT-5.6-Gegenstücken, darunter eine geringere Rate irreführender Aussagen über ihre eigene Programmierarbeit.
Preise: 75 % Rabatt, dieselben Modelle, dieselbe API
Smart AIPI berechnet 25 % des Listenpreises von OpenAI. Hier ist die Berechnung für beide Modelle.
| gpt-6-sol, pro 1M Tokens | Direkt bei OpenAI | Smart AIPI | Ihre Ersparnis |
|---|---|---|---|
| Eingabe | $2.00 | $0.50 | 75% |
| Gecachte Eingabe | $0.20 | $0.05 | 75% |
| Ausgabe | $10.00 | $2.50 | 75% |
| gpt-6-luna, pro 1M Tokens | Direkt bei OpenAI | Smart AIPI | Ihre Ersparnis |
|---|---|---|---|
| Eingabe | $0.10 | $0.025 | 75% |
| Gecachte Eingabe | $0.01 | $0.0025 | 75% |
| Ausgabe | $0.50 | $0.125 | 75% |
Beide Modelle übernehmen außerdem das verbesserte Prompt-Caching von GPT-6 – höhere standardmäßige Cache-Trefferraten und einen 90%-Rabatt auf das Lesen gecachter Eingaben –, sodass Agents und lange Unterhaltungen mit wiederverwendetem Kontext noch günstiger werden. Dieselben Gewichte, dieselbe OpenAI-kompatible API-Struktur, dieselben Tools. Der einzige Unterschied ist die Rechnung.
Ein klarerer Kommunikationsstil
Sol und Luna übernehmen Astras verbesserten Kommunikationsstil, der in technischen und Programmierunterhaltungen besonders auffällt: mehr Klarheit, weniger Fachjargon, weniger ungewöhnliche Formulierungen, weniger Details mit geringem Mehrwert und etwas kürzere Antworten, ohne an Substanz zu verlieren. In der Praxis bedeutet das einen Agent, der nicht vorschnell Schlüsse zieht, offener darüber informiert, was er geprüft hat und was nicht, und weniger Tokens damit verschwendet, Offensichtliches zu wiederholen.
So verwenden Sie GPT-6 Sol und Luna
Chat Completions API
curl https://api.smartaipi.com/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-sol",
"messages": [{"role": "user", "content": "Refactor this module and add tests"}]
}'
Responses API mit hoher Schlussfolgerungsleistung
curl https://api.smartaipi.com/v1/responses \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-sol",
"input": "Triage these open issues and open PRs to fix the top three",
"reasoning": {"effort": "high", "summary": "auto"}
}'
Codex CLI, Cursor, Cline, Roo Code, OpenCode, Aider
OPENAI_BASE_URL=https://api.smartaipi.com/v1
OPENAI_API_KEY=sk-your-smart-aipi-key
OPENAI_MODEL=gpt-6-luna
Der Schlussfolgerungsaufwand unterstützt low, medium, high und xhigh. Sol und Luna skalieren sinnvoll mit dem Aufwand – die oben genannten Ergebnisse von AutomationBench, Agents' Last Exam und OSWorld wurden allesamt mit höheren Aufwandseinstellungen erzielt. Verwenden Sie für Agentenarbeit mit langem Zeithorizont high oder xhigh; für hohen Durchsatz ist low oder medium mit Luna die kostengünstige Standardeinstellung.
Welches Modell sollten Sie tatsächlich ausführen?
- gpt-6-astra – das beste Modell in jeder Hinsicht. Wählen Sie es, wenn Sie die besten Ergebnisse und eine kompromisslose Erfahrung wünschen: Computernutzung, Browser-Automatisierung und Refactorings mit langem Zeithorizont, bei denen das unbeaufsichtigte Fertigstellen entscheidend ist.
- gpt-6-sol – anspruchsvolle Arbeit zu einem Bruchteil der Frontier-Kosten. Schlägt Claude Opus 5 auf AutomationBench bei ~9 % der Kosten und liegt bei DeepSWE bei ~80 % geringeren Kosten innerhalb eines Punktes von Fable 5. Die richtige Standardeinstellung für agentische Programmierung mit hohem Volumen und Geschäftsautomatisierung.
- gpt-6-luna – die schnelle, günstige Stufe. DeepSWE-Ergebnisse nahe an Frontier-Modellen bei 90 %+ geringeren Kosten als Opus/Fable. Ideal für Massenverarbeitung, Klassifizierung, Zusammenfassungen und Pipelines mit hohem Durchsatz.
Alle drei Modelle laufen über denselben Endpunkt und denselben Schlüssel. Der Wechsel erfordert eine einzige Zeile, testen Sie sie also mit Ihrer Arbeitslast, statt der Darstellung anderer zu vertrauen – einschließlich dieser hier.
Erste Schritte
Inklusive kostenloser Credits. Jedes neue Konto erhält $5 kostenlose Credits. Registrieren Sie sich unter smartaipi.com/signup, erstellen Sie einen API-Schlüssel und beginnen Sie sofort mit der Nutzung von gpt-6-sol und gpt-6-luna. Keine Kreditkarte erforderlich.
- Registrieren Sie sich unter smartaipi.com/signup (kostenlose Credits, keine Kreditkarte)
- Erstellen Sie einen API-Schlüssel im Dashboard
- Setzen Sie Ihre Basis-URL auf
https://api.smartaipi.com/v1 - Verwenden Sie das Modell
gpt-6-solodergpt-6-luna
Intelligenz der Astra-Generation, auf Kosten optimiert, in der Produktion – zum Viertel des Listenpreises.
OpenAI-kompatibles API-Gateway. Greife auf Frontier-AI-Modelle zu 75% geringeren Kosten zu.
Kostenlos starten