GPT-6.1 Sol 功能解析:上下文、工具调用、API 价格与使用边界
根据 OpenAI 官方文档了解 GPT-6.1 Sol 的编程、计算机操作与专业工作能力,以及 105 万上下文、推理档位、缓存定价和接入限制。

想在项目里试 GPT-6.1 Sol?它面向复杂编程、计算机操作和专业工作。OpenAI 将它定位为一款成本低于 GPT-6 Astra、能力接近的模型。接入前,值得先看清上下文容量、工具接口和长请求的计费方式。
核心规格一览
| 项目 | 官方文档中的 GPT-6.1 Sol |
|---|---|
| API 模型 ID | gpt-6.1-sol |
| 上下文窗口 | 1,050,000 token |
| 最大输入 / 最大输出 | 922,000 / 128,000 token |
| 输入 → 输出 | 文本、图片 → 文本 |
| 推理档位 | low、medium、high、xhigh、max;默认 medium |
| 工具调用接口 | Responses API;Chat Completions 仅支持不带工具的请求 |
来源:GPT-6.1 Sol 模型文档。上下文窗口是整体容量;单次输入上限为 922,000 token,还需为输出预留空间。
编程:关注可验证的工程结果
OpenAI 的发布评测称,GPT-6.1 Sol 在 DeepSWE v1.1 中以约五分之一的任务成本达到 GPT-6 Astra 的表现。该测试面向真实代码库中的复杂工程任务;具体到你的项目,仍要用相同的任务和环境检验效果。GPT-6.1 Sol 发布说明
对实际代码项目,建议用可复现的验收条件测试:一个明确的缺陷、固定仓库版本、明确的测试命令,以及是否引入行为回退的人工检查。模型生成补丁只是中间过程,能否通过测试、保持业务行为并解释修改依据,才是可交付结果。
迁移时也应记录模型之外的变量:工具权限、网络访问、依赖安装和最长运行时间。否则一次失败可能来自环境,而不是推理能力本身。
计算机操作与专业文档工作
官方模型文档列出 computer use、web search、file search、code interpreter、hosted shell、apply patch、MCP 和 tool search 等工具支持。它还支持流式响应和结构化输出。
这些能力适合组合成工作流,例如读取资料、执行分析、检查结果,再生成结构化交付物。工具支持不是自动访问授权:应用仍需提供工具、处理执行结果,并定义任务边界。
尤其要区分图片输入和图片生成。Sol 可以理解图片并输出文字;调用 image generation 工具,是把图像任务交给相关工具处理,不能据此将 Sol 描述为原生图片、音频或视频输出模型。
对于 PDF、表格和研究材料,建议在验收中单独检查数字、引用和缺失信息处理。遇到新近信息,还应提供最新资料或使用检索,再核对答案。
推理档位怎么选
GPT-6.1 Sol 不支持 none 和 minimal,默认档位为 medium。
可以按任务难度,从以下档位开始试用:
| 测试起点 | 可尝试的任务 | 重点观察 |
|---|---|---|
low |
边界清楚、验收简单的请求 | 是否减少等待而保持正确率 |
medium |
日常编码、文档分析、多步工具任务 | 任务质量和费用是否稳定 |
high 及以上 |
难定位的缺陷、复杂约束、多来源分析 | 新增推理是否实际减少返工 |
不要默认最高档最划算。如果一个任务在较低档位已稳定通过验收,提高档位可能只是增加支出;如果失败后的人工返工很贵,则更高档位也可能有价值。应比较每个成功任务的总费用。
官方 API 价格与长上下文规则
单位为美元 / 百万 token,以下是 Standard 费率:
| 输入长度 | 普通输入 | 缓存读取 | 缓存写入 | 输出 |
|---|---|---|---|---|
| 不超过 272K token | 2.00 | 0.10 | 2.50 | 10.00 |
| 超过 272K token | 4.00 | 0.20 | 5.00 | 15.00 |
来源:OpenAI API 定价。超过阈值时,长上下文价格适用于整个请求,而不只是超过的部分。Fast 为 Standard 的两倍;Batch 和 Flex 比 Standard 低 50%,但适用条件与实时请求不同。
例如,一个假设请求包含 100,000 个未缓存输入 token 和 10,000 个计费输出 token,则模型 token 费用为:
0.1 × $2 + 0.01 × $10 = $0.30
如果输入变成 300,000 token,同样产生 10,000 个计费输出 token,则为:
0.3 × $4 + 0.01 × $15 = $1.35
这是按费率计算的示例,不是实测账单;未包含工具调用、区域处理等额外费用。估算时要使用完整计费用量,不能只统计最后展示给用户的回答。
可用入口与 PoYo 链接
OpenAI 已公布 API、ChatGPT Work 和 Codex 的 GPT-6.1 Sol 入口。实际可用性取决于套餐、客户端和工作区设置。
OpenAI 的发布说明指出,Sol 尚未进入普通 Chat;Sol Ultrafast 也仍在后续计划中,目前公布的处理模式为 Standard 和 Fast。
如果准备通过 PoYo 使用 Sol,可以先查看 PoYo GPT-6.1 Sol 模型页。截至 2026 年 9 月 30 日,该页面标注“即将上线”;开放后的价格、接口与工具支持,请以 PoYo 页面和控制台的实际信息为准。上文的规格与价格说明针对 OpenAI 原生 API。
其他 OpenAI 模型可在 PoYo OpenAI 厂商页浏览;已开放的聊天模型可在 AI Chat API 聚合页查看。
试用时重点看什么
- 复杂任务的完成质量。 用真实的代码或文档任务与现有模型对比,记录结果和返工次数。官方所说的“接近 Astra”,也要放到自己的任务中验证。
- 事实和引用的准确性。 抽样核对新近事实、数字与出处,尤其是需要交付给他人的内容。
- 完成整项任务的时间。 将推理、排队、工具调用和重试都计入耗时,观察不同输入长度下的表现。
- 长资料中的信息定位。 用长文档测试跨段检索、遗漏和引用位置;上下文窗口大小只是起点。
选一组有代表性的任务,按同一标准记录成功率、总 token、完整耗时和人工修改量,就能更清楚地判断 Sol 是否适合你的工作流。若还在比较不同厂商,可看 GPT-6.1 Sol vs Claude Opus 5.5;了解发布背景,可看 DevDay 2026 回顾。
常见问题
GPT-6.1 Sol 是 GPT-6 Sol 的另一个名字吗?
不是。OpenAI 将它作为 GPT-6 Sol 的升级发布,API ID 为 gpt-6.1-sol,评测时必须记录确切版本。
能直接生成图片或视频吗?
模型的原生输出是文本。图片生成工具与 Sol 本身的输出模态需要分别理解,不能宣称它原生输出视频。
能用 Chat Completions 调用工具吗?
按当前官方文档,GPT-6.1 Sol 的工具调用应使用 Responses API;Chat Completions 支持无工具请求。


