GPT-6.1 SOL · POYO 即将上线

一个模型支持编程、文档分析、计算机操作与多步骤智能体任务

GPT-6.1 Sol API:支持编程与智能体工作流

GPT-6.1 Sol 是 OpenAI 面向复杂编程、计算机操作与专业工作的 Sol 模型。它支持智能体理解代码、使用工具、阅读详细文档,并持续完成多步骤任务。

105 万 Token 上下文窗口与可调节的推理强度,有助于开发者处理大型代码库和长篇资料。OpenAI 的评测显示,它在软件工程、文档理解、业务自动化与计算机操作方面较 GPT-6 Sol 取得进展。

GPT-6.1 Sol API 的核心功能

面向跨代码、文档与应用界面工作的开发团队和智能体。

01

复杂编程与软件工程

GPT-6.1 Sol 可理解代码库、追踪问题、修改多个文件,并在较长的开发任务中验证改动。OpenAI 的 DeepSWE v1.1 评测显示,它达到 GPT-6 Astra 的成绩,并在较低推理强度下比 GPT-6 Sol 的最佳成绩高 6.4 个百分点。

  • 跨多个文件理解代码
  • 实现并验证明确范围的改动
  • 支持长期运行的编程智能体
OpenAI DeepSWE v1.1 软件工程评测:GPT-6.1 Sol、GPT-6 Sol 与 GPT-6 Astra

02

文档理解与业务工作流

GPT-6.1 Sol 可处理包含表格、图表、示意图与细节注释的复杂 PDF,也能协调使用多种工具的业务流程。OpenAI 报告其 GDP.pdf 评测表现较 GPT-6 Sol 提升,在中等推理强度的 AutomationBench 评测中高出 4.8 个百分点。

  • 阅读复杂表格与图示
  • 关联长文档中的关键信息
  • 推进多步骤工具工作流
OpenAI GDP.pdf 专业文档理解评测中的 GPT-6.1 Sol 表现

03

跨应用的计算机操作

GPT-6.1 Sol 可理解视觉信息,并在智能体流程中操作应用界面。OpenAI 报告,在最高推理强度的 OSWorld 2.0 离线评测中,它比 GPT-6 Sol 高 7 个百分点。团队可将截图理解、界面操作与结果检查连接到同一流程。

  • 理解截图与界面状态
  • 执行跨应用界面的任务
  • 在每一步后检查结果
OpenAI OSWorld 2.0 离线计算机操作评测中的 GPT-6.1 Sol 表现

04

长上下文与可调节推理

GPT-6.1 Sol 支持最多 105 万 Token 上下文与 12.8 万 Token 输出。开发者可选择 low、medium、high、xhigh 或 max 推理强度,匹配任务所需的分析深度。OpenAI 的事实准确性评测也显示,它在低推理强度下能给出更可靠的回答。这些能力适用于大型代码仓库、长篇报告与持续运行的智能体会话。

  • 读取最多 105 万 Token 上下文
  • 按任务选择五档推理强度
  • 生成最多 12.8 万 Token 输出
OpenAI 评测 GPT-6.1 Sol 与其他 GPT-6 模型在不同推理强度下的事实准确性

谁能从 GPT-6.1 Sol API 中受益?

01

软件开发团队

使用 GPT-6.1 Sol 理解代码仓库、开发功能、修复问题,并在跨文件任务中检查改动。

02

智能体开发者

构建能够规划步骤、调用工具、检查结果,并结合先前操作上下文继续工作的智能体。

03

文档与研究团队

分析包含图表与复杂细节的 PDF,整合文字和视觉证据,形成有来源依据的摘要。

04

产品与质量保障团队

结合截图和应用状态理解界面、执行操作流程,并检查可观察的结果。

05

运营团队

在工具、文档与交接环节之间协调可重复的业务流程,并跟踪每一步。

06

科研与数据团队

借助代码与逐步验证,推进终端中的数据分析、模拟和研究任务。

GPT-6.1 Sol、GPT-6 Sol 与 GPT-6 Astra 模型对比

能力GPT-6.1 SolGPT-6 SolGPT-6 Astra
模型定位复杂编程、计算机操作与专业工作流复杂编程与智能体工作流要求最高的端到端任务
DeepSWE v1.1与 Astra 持平;较 Sol 最佳成绩高 6.4 个百分点6.1 Sol 较其最佳成绩高 6.4 个百分点与 6.1 Sol 持平
OSWorld 2.0 离线评测(最高推理强度)较 Sol 高 7 个百分点;与 Astra 相差 2.1 个百分点6.1 Sol 较其高 7 个百分点较 6.1 Sol 高 2.1 个百分点
Terminal-Bench Science 0.1(最高推理强度)得分超过 Sol 的两倍6.1 Sol 得分超过该模型两倍官方公布的最高得分:68.1%
事实错误率(低推理强度)7.7%11.4%在各已测试推理强度下,6.1 Sol 与其相差不超过 1.9 个百分点
官方价格 · 标准输入 / 百万 Token$2.00$2.00$10.00
官方价格 · 缓存输入 / 百万 Token$0.10$0.20$1.00
官方价格 · 缓存写入 / 百万 Token$2.50$2.50$12.50
官方价格 · 标准输出 / 百万 Token$10.00$10.00$50.00

关于 GPT-6.1 Sol API 的常见问题

GPT-6.1 Sol 是什么?

GPT-6.1 Sol 是 OpenAI 面向复杂编程、计算机操作与专业工作流的 Sol 模型。它支持跨代码、文档、工具和应用界面持续工作的智能体。

GPT-6.1 Sol 能怎样帮助软件开发团队?

团队可使用 GPT-6.1 Sol 理解大型代码库、修改多个文件、排查问题并验证结果。OpenAI 报告,它在 DeepSWE v1.1 评测中达到 GPT-6 Astra 的成绩,比 GPT-6 Sol 的最佳成绩高 6.4 个百分点。

GPT-6.1 Sol 如何处理文档和业务任务?

它可以阅读带有表格、图表、示意图和细节注释的复杂 PDF,并关联长篇资料中的信息。它也支持多步骤工具工作流;OpenAI 报告其中等推理强度下的 AutomationBench 成绩比 GPT-6 Sol 高 4.8 个百分点。

GPT-6.1 Sol 支持多大的上下文和哪些推理强度?

GPT-6.1 Sol 支持 105 万 Token 上下文窗口与最多 12.8 万 Token 输出。开发者可根据任务选择 low、medium、high、xhigh 或 max 推理强度。

GPT-6.1 Sol 的官方 API 价格优势是什么?

按 OpenAI 对输入不超过 272K Token 请求的标准 API 价格,GPT-6.1 Sol 每百万 Token 输入 $2、输出 $10,均比 GPT-6 Astra 的 $10 和 $50 低 80%;缓存输入 $0.10,比 GPT-6 Sol 的 $0.20 低 50%。这些是 OpenAI 直连价格;PoYo 价格将随上线公布。

GPT-6.1 Sol 什么时候在 PoYo 上线?

GPT-6.1 Sol 即将在 PoYo 上线。本页汇集编程、文档理解、计算机操作与智能体能力,帮助团队提前规划集成方式。

为什么选择 PoYo 集成 GPT-6.1 Sol API?

01

统一模型目录

在 PoYo 模型目录中查看 GPT-6.1 Sol,并集中了解它的编程、文档、计算机操作与智能体能力。

02

依据公开评测选型

结合 OpenAI 公布的评测结果,对照 GPT-6.1 Sol、GPT-6 Sol 与 GPT-6 Astra,选择适合团队任务的模型。

03

规划开发工作流

根据长上下文输入、推理强度与工具步骤,规划编程任务和智能体工作流的集成方式。

04

关注 PoYo 上线进展

关注 GPT-6.1 Sol 在 PoYo 的即将上线状态,并通过本页提前了解相关能力。