GPT-6.1 SOL · POYO で近日提供

コーディング、文書分析、コンピューター操作、複数ステップのエージェントを一つのモデルで

コーディングとエージェントワークフローのための GPT-6.1 Sol API

GPT-6.1 Sol は、複雑なコーディング、コンピューター操作、専門的な業務に向けた OpenAI の Sol モデルです。コードの調査、ツールの利用、詳細な文書の読解を行い、複数ステップにわたるタスクを進めるエージェントを支えます。

最大 1,050,000 トークンのコンテキストウィンドウと調整可能な推論レベルにより、開発者は大規模なコードベースや長い資料を扱えます。OpenAI は、ソフトウェアエンジニアリング、文書理解、業務自動化、コンピューター操作の評価で GPT-6 Sol を上回る結果を報告しています。

GPT-6.1 Sol API の主な機能

コード、文書、アプリケーションを横断して作業する開発チームとエージェントのための機能。

01

複雑なコーディングとソフトウェアエンジニアリング

GPT-6.1 Sol はコードベースの調査、障害原因の追跡、複数ファイルの編集、長期の開発タスクにおける変更の検証に対応します。OpenAI の DeepSWE v1.1 評価では GPT-6 Astra と同等の結果に達し、より低い推論レベルで GPT-6 Sol の最高スコアを 6.4 パーセントポイント上回りました。

  • 複数ファイルにまたがるコードを調査
  • 範囲を定めた変更を実装・検証
  • 長時間稼働するコーディングエージェントを支援
ソフトウェア開発タスクにおける GPT-6.1 Sol、GPT-6 Sol、GPT-6 Astra の OpenAI DeepSWE v1.1 評価

02

文書理解と業務ワークフロー

GPT-6.1 Sol は、表、グラフ、図、細かな注記を含む詳細な PDF を扱えます。多数のツールを使う複数ステップの業務フローも調整できます。OpenAI は、GDP.pdf で GPT-6 Sol を上回り、中程度の推論レベルでの AutomationBench では 4.8 ポイント改善したと報告しています。

  • 複雑な表や図を読み取る
  • 長い文書に分散した情報を関連付ける
  • 複数ステップのツールワークフローを実行
専門的な文書理解に関する GPT-6.1 Sol の OpenAI GDP.pdf 評価

03

アプリケーションを横断するコンピューター操作

GPT-6.1 Sol は視覚的な状況を理解し、エージェントワークフローの一部としてアプリケーションの画面を操作できます。OpenAI によると、オフラインの OSWorld 2.0 評価では最大の推論レベルで GPT-6 Sol を 7 ポイント上回りました。スクリーンショットの理解、画面操作、結果の確認を一つのプロセスにつなげられます。

  • スクリーンショットと画面の状態を理解
  • アプリケーションの画面をまたいで作業
  • 各操作の後に結果を確認
コンピューター操作における GPT-6.1 Sol の OpenAI OSWorld 2.0 オフライン評価

04

長いコンテキストと調整可能な推論

GPT-6.1 Sol は最大 1,050,000 トークンのコンテキストを受け取り、最大 128,000 トークンを出力します。開発者はタスクに応じて low、medium、high、xhigh、max の推論レベルを選択できます。OpenAI の事実の正確性に関する評価では、低い推論レベルでもより信頼できる回答を示しています。大規模なリポジトリ、長いレポート、継続的なエージェントセッションに対応します。

  • 最大 1,050,000 トークンのコンテキストを読み取る
  • 5 段階の推論レベルから選択
  • 最大 128,000 トークンを出力
異なる推論レベルにおける GPT-6.1 Sol とその他の GPT-6 モデルの事実の正確性に関する OpenAI の評価

GPT-6.1 Sol API はどのようなチームに役立ちますか?

01

ソフトウェア開発チーム

GPT-6.1 Sol を使ってリポジトリの調査、機能の実装、不具合の修正、複数ファイルにまたがる変更のレビューを進められます。

02

エージェント開発者

手順を計画し、ツールを呼び出し、結果を確認して、以前の操作を踏まえて作業を続けるエージェントを構築できます。

03

文書・研究チーム

詳細な PDF を分析し、グラフと文章の根拠を組み合わせて、出典に基づく要約を作成できます。

04

プロダクト・品質保証チーム

スクリーンショットとアプリケーションの状態を使って画面を調べ、手順を実行し、確認できる結果を検証できます。

05

業務運用チーム

ツール、文書、引き継ぎをまたぐ反復可能な業務プロセスを調整し、各ステップを追跡できます。

06

科学・データチーム

コードと反復的な確認が必要な分析、シミュレーション、研究をターミナル上で進められます。

GPT-6.1 Sol、GPT-6 Sol、GPT-6 Astra のモデル比較

能力GPT-6.1 SolGPT-6 SolGPT-6 Astra
モデルの主な用途複雑なコーディング、コンピューター操作、専門的なワークフロー複雑なコーディングとエージェントワークフロー最も要求の厳しいエンドツーエンドのタスク
DeepSWE v1.1Astra と同等。Sol の最高スコアより 6.4 パーセントポイント高い6.1 Sol はこのモデルの最高スコアより 6.4 パーセントポイント高い6.1 Sol と同等
OSWorld 2.0 オフライン(最大推論レベル)Sol より 7 パーセントポイント高く、Astra との差は 2.1 ポイント6.1 Sol は 7 パーセントポイント高い6.1 Sol より 2.1 パーセントポイント高い
Terminal-Bench Science 0.1(最大推論レベル)Sol のスコアの 2 倍超6.1 Sol はこの結果の 2 倍超公表された最高スコア:68.1%
事実誤認率(低推論レベル)7.7%11.4%検証された推論レベルでは 6.1 Sol との差は 1.9 パーセントポイント以内
公式料金 · 通常入力 / 100 万トークン$2.00$2.00$10.00
公式料金 · キャッシュ入力 / 100 万トークン$0.10$0.20$1.00
公式料金 · キャッシュ書き込み / 100 万トークン$2.50$2.50$12.50
公式料金 · 通常出力 / 100 万トークン$10.00$10.00$50.00

GPT-6.1 Sol API に関するよくある質問

GPT-6.1 Sol とは何ですか?

GPT-6.1 Sol は、複雑なコーディング、コンピューター操作、専門的なワークフローに向けた OpenAI の Sol モデルです。コード、文書、ツール、アプリケーションの画面を横断して継続的に作業するエージェントを支えます。

GPT-6.1 Sol はソフトウェアチームにどう役立ちますか?

大規模なコードベースの調査、複数ファイルの編集、問題の調査、変更の検証に利用できます。OpenAI によると、DeepSWE v1.1 では GPT-6 Astra と同等で、GPT-6 Sol の最高スコアを 6.4 パーセントポイント上回ります。

GPT-6.1 Sol は文書や業務タスクをどう支援しますか?

表、グラフ、図、細かな注記を含む詳細な PDF を読み取り、長い資料に散らばる情報を結び付けます。複数ステップのツールワークフローにも対応し、OpenAI は中程度の推論レベルでの AutomationBench で GPT-6 Sol より 4.8 ポイント高いと報告しています。

GPT-6.1 Sol のコンテキスト長と推論レベルは?

GPT-6.1 Sol は 1,050,000 トークンのコンテキストウィンドウと最大 128,000 トークンの出力に対応します。開発者はタスクに応じて low、medium、high、xhigh、max を設定できます。

GPT-6.1 Sol API の公式料金にはどのような利点がありますか?

入力が最大 272,000 トークンのリクエストに適用される OpenAI の標準 API 料金では、GPT-6.1 Sol は 100 万トークンあたり入力 $2、出力 $10 で、GPT-6 Astra の入力 $10、出力 $50 よりそれぞれ 80% 安くなります。キャッシュ入力は $0.10 で、GPT-6 Sol の $0.20 より 50% 安い価格です。これらは OpenAI の直接 API 料金で、PoYo の料金は提供開始時に公開します。

GPT-6.1 Sol はいつ PoYo で利用できますか?

GPT-6.1 Sol は PoYo で近日提供予定です。このページでは、チームが統合を計画できるよう、コーディング、文書、コンピューター操作、エージェントの機能をまとめています。

GPT-6.1 Sol API の統合に PoYo を選ぶ理由

01

統一されたモデルカタログ

PoYo のほかのモデルと並べて GPT-6.1 Sol を見つけ、コーディング、文書、コンピューター操作、エージェントの機能を一か所で確認できます。

02

公開された評価に基づいて選択

OpenAI が公開したベンチマークを使い、チームのタスクに合わせて GPT-6.1 Sol、GPT-6 Sol、GPT-6 Astra を比較できます。

03

開発ワークフローを計画

長いコンテキストの入力、推論レベル、ツールの利用手順を、コーディングやエージェントのワークフローにどう組み込むか計画できます。

04

PoYo での提供開始を確認

PoYo での GPT-6.1 Sol の提供予定を確認し、このページを統合準備に役立ててください。