GPT-6.1 Sol 已上线 Smart AIPI —— 以五分之一价格获得近乎 Astra 的智能水平
OpenAI 的 GPT-6.1 Sol 升级了 GPT-6 Sol,在智能体编程、计算机使用和专业工作方面几乎可媲美 GPT-6 Astra —— 代币价格仅为 Astra 的五分之一。现已于 Smart AIPI 上线,价格为每 1M $0.50 / $0.025 / $2.50 —— 比 OpenAI 的 $2 / $0.10 / $10 低 75%。以下是实际基准测试结果与定价分析。
摘要: gpt-6.1-sol 今日已在 Smart AIPI 上线,价格为每 1M tokens $0.50 / $0.025 / $2.50 —— 比 OpenAI 的 $2 / $0.10 / $10 低 75%。它是 GPT-6 Sol 的升级版,在智能体编程、计算机使用和专业工作方面几乎可媲美 GPT-6 Astra,价格约为 Astra 的五分之一。下文将介绍实际基准测试、注意事项,以及为何 $0.025/1M 的缓存输入会改变智能体的成本模型。
OpenAI 发布了 GPT-6.1 Sol,这是 GPT-6 Sol 的升级版,在智能体编程、计算机使用和专业工作方面的智能水平几乎可媲美 GPT-6 Astra —— 而标准输入和输出 token 价格仅为 Astra 的五分之一。它在 API 中以 gpt-6.1-sol 提供,并已立即登录 Smart AIPI,价格仅为 OpenAI 的四分之一。
发布文章通常是营销内容。这篇不是 —— 我们销售的是模型访问权限,因此我们能做的有用之事,就是准确告诉你它在哪些方面胜出、Astra 仍在哪些方面领先,以及它实际会花费多少。以下所有数字均来自 OpenAI 已发布的评估结果。
GPT-6.1 Sol 在产品阵容中的定位
| 模型 | 最适合 | OpenAI 输入 / 输出 / 缓存(每 1M) |
|---|---|---|
| GPT-6 Astra | 最智能,效果最佳 | $10 / $50 / $1 |
| GPT-6.1 Sol | 接近 Astra 的智能水平,价格仅为五分之一 | $2 / $10 / $0.10 |
| GPT-6 Luna | 快速、高效地处理大规模日常工作 | $0.10 / $0.50 / $0.01 |
在 Smart AIPI 上,你只需支付这些价格的 25%。核心要点是:GPT-6.1 Sol 在复杂专业任务上相较 GPT-6 Sol 有显著提升 —— 包括编写和调试代码、理解文档以及执行多步骤业务工作流 —— 并且在若干评估中以很低的成本接近 Astra 的性能。
对开发者重要的结果
| 基准测试 | GPT-6.1 Sol 结果 |
|---|---|
| DeepSWE v1.1(编程) | 以约 1/5 的成本匹配 GPT-6 Astra;在更低推理强度下比 GPT-6 Sol 高 +6.4 pts |
| GDP.pdf(文档问答) | 以低于一半的成本击败带回退机制的 Opus 5.5;以约 1/5 成本接近 Astra |
| AutomationBench(工作流) | 以约 1/3 成本比 Opus 5.5(中等)高 +2.2 pts;比 GPT-6 Sol 高 +4.8 pts |
| OSWorld 2.0 离线集(计算机使用) | 以低于一半成本比 GPT-6 Sol 高 +7 pts;以约 1/7 成本与 Astra 相差 2.1 pts |
| Terminal-Bench Science 0.1 | 超过 GPT-6 Sol 的 2×;$5.47/task 对比 $23.21(Opus 5.5)/ $23.80(Astra) |
| 事实准确性(高难提示词,低推理强度) | 错误率从 11.4% → 7.7%(约减少 32%);与 Astra 相差 1.9 pts 以内 |
编程
在评估真实代码库中复杂软件工程任务的 DeepSWE v1.1 上,GPT-6.1 Sol 以约五分之一的成本匹配 GPT-6 Astra,同时在更低的推理强度和成本下,比 GPT-6 Sol 的最佳得分高出 6.4 个百分点。这是少有的既更好、运行成本又更低的升级。
专业工作
在 GDP.pdf 上 —— 该测试包含来自金融、医疗保健、法律及其他七个领域的复杂 PDF 真实提示词(表格、图表、图示、小字条款)—— GPT-6.1 Sol 的得分高于每项任务成本不到一半的带回退机制 Opus 5.5,并以约五分之一的成本接近 Astra 的业界领先表现。在 AutomationBench(涵盖 47 个工具的多步骤业务工作流)上,它在中等推理强度下以约三分之一的成本获得比 Opus 5.5 高 2.2 分的成绩 —— 相比同一设置下的 GPT-6 Sol 提升 4.8 分。
计算机使用
在 OSWorld 2.0 的离线集上,GPT-6.1 Sol 在最大推理强度下以低于一半的成本比 GPT-6 Sol 高出七个百分点,并以每项任务约七分之一的成本与 Astra 相差 2.1 分。Astra 仍是最强的计算机使用模型;GPT-6.1 Sol 则以很小一部分支出实现了大部分能力。
科学研究
在 Terminal-Bench Science 0.1(数据分析、模拟、定理证明)上,GPT-6.1 Sol 在最大强度下的得分超过 GPT-6 Sol 的两倍,成本不到一半。在最高强度下,其平均成本为每项任务 $5.47,而 Opus 5.5 为 $23.21、Astra 为 $23.80 —— 比两者任一都便宜超过 75%。Astra 仍以 68.1% 位居该基准测试榜首,依然是最困难研究任务的首选。
事实准确性
在困难且易引发错误的提示词上,GPT-6.1 Sol 最大的提升出现在低推理强度下:含有事实错误的回答占比从 11.4% 降至 7.7% —— 约减少 32%。在所有测试设置中,其错误率都以不到五分之一的成本保持在距 Astra 1.9 分以内。(这些是刻意设计的高难提示词,不能反映事实错误更少的典型使用情况。)
对齐:可量化地更接近 Astra
在 OpenAI 的对齐评估中,GPT-6.1 Sol 相对 GPT-6 Sol 展现出显著提升 —— 它更透明地说明自身局限性,也更可靠地遵守用户意图和安全约束。一个具体例子是:当搜索工具损坏时会披露,而不是猜测(越低越好):
| 模型 | 搜索损坏未披露率(越低越好) |
|---|---|
| GPT-6 Astra | 1.5% |
| GPT-6.1 Sol | 2.1% |
| GPT-6 Sol | 4.9% |
| GPT-6 Luna | 28.7% |
它还表现出未尝试绕过自动化安全审查器,与 GPT-6 Astra 和 GPT-6 Sol 一致。完整详情请参阅 OpenAI 的 GPT-6.1 Sol 系统卡增补说明。
缓存输入的价值
对智能体而言,一个至关重要但不易察觉的数字是:OpenAI 标价中,缓存输入为每 1M $0.10 —— 比标准输入便宜 95%,且是 GPT-6 Sol 缓存费率的一半。在 Smart AIPI 上,这一价格为每 1M 缓存输入 $0.025。如果你的智能体会在请求之间复用大型系统提示词、工具 schema 或文档上下文,则重新发送这些上下文的成本几乎可以忽略不计。结合 Smart AIPI 的 75% 折扣,GPT-6.1 Sol 是运行具备强大能力、上下文密集型智能体最便宜的方式之一。
本讲解详细分析了缓存读取价格减半为何会改变上下文密集型智能体的经济模型,并说明为何今后应默认使用 GPT-6.1 Sol:
结论与上述数字一致:凭借价格减半的缓存读取和接近 Astra 的质量,GPT-6.1 Sol 是大多数智能体工作负载合理的新默认选择 —— 仅在最困难的任务上选择 Astra。
定价:75% 折扣,相同模型,相同 API
| gpt-6.1-sol,每 1M tokens | 直接使用 OpenAI | Smart AIPI | 你节省 |
|---|---|---|---|
| 输入 | $2.00 | $0.50 | 75% |
| 缓存输入 | $0.10 | $0.025 | 75% |
| 输出 | $10.00 | $2.50 | 75% |
相同权重、相同 OpenAI 兼容 API 形式、相同工具。唯一的区别是账单。
如何使用 GPT-6.1 Sol
Chat Completions API
curl https://api.smartaipi.com/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6.1-sol",
"messages": [{"role": "user", "content": "Refactor this module and add tests"}]
}'
使用高推理强度的 Responses API
curl https://api.smartaipi.com/v1/responses \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6.1-sol",
"input": "Triage these open issues and open PRs to fix the top three",
"reasoning": {"effort": "high", "summary": "auto"}
}'
Codex CLI、Cursor、Cline、Roo Code、OpenCode、Aider
OPENAI_BASE_URL=https://api.smartaipi.com/v1
OPENAI_API_KEY=sk-your-smart-aipi-key
OPENAI_MODEL=gpt-6.1-sol
推理强度支持 low、medium、high 和 xhigh。GPT-6.1 Sol 能很好地随强度扩展 —— 上述多项结果均在最大强度下取得,此时它的每项任务成本仍只是 Astra 的一小部分。最高可实现 8x 更快 token 生成的 GPT-6.1 Sol Ultrafast 变体即将推出。
实际应该运行哪个模型?
- gpt-6-astra —— 最智能的模型,适用于追求最佳结果和最困难任务:最艰巨的研究、长周期计算机使用,以及任何以无人值守完成为目标的工作。
- gpt-6.1-sol —— 以五分之一的价格提供接近 Astra 的智能水平。严肃智能体编程、文档工作、业务自动化和科学任务的新默认选择:当你希望获得 Astra 大部分质量而无需承担 Astra 账单时,请选择它。
- gpt-6-sol —— 仍是强大且缓存成本更低的选择;gpt-6.1-sol 以相同的输入/输出价格在质量上取代了它。
- gpt-6-luna —— 快速、高效地处理大规模日常工作:批量任务、分类、摘要和高吞吐量管道。
四个模型均使用相同端点和同一个密钥。切换只需修改一行,因此请在你的工作负载上进行基准测试,而不是相信任何人的图表 —— 包括这张。
开始使用
包含免费额度。 每个新账户都可获得 $5 免费额度。前往 smartaipi.com/signup 注册,创建 API 密钥,并立即开始使用 gpt-6.1-sol。无需信用卡。
- 在 smartaipi.com/signup 注册(免费额度,无需信用卡)
- 在控制面板中创建 API 密钥
- 将基础 URL 设为
https://api.smartaipi.com/v1 - 使用模型
gpt-6.1-sol
接近 Astra 的智能水平,已投入生产环境,价格仅为五分之一 —— 在 Smart AIPI 上更是其四分之一。