AIチャットAPI

開発者向けの AI API

AIチャットAPI

PoYo AI チャット API を使用して、書き込み、推論、コーディング機能を構築します。 LLM モデル、会話プロトコル、サポートされている入力、応答制御、トークン価格を比較します。

対応モデル

27 個のモデル

Kimi K3
チャット

$2.28 100万入力

kimi-k3

Moonshot AI's 2.8T-parameter flagship multimodal model with a 1M-token context window, built for long-horizon coding, deep reasoning, knowledge work, and tool-using agents.

Claude Sonnet 5
チャット

$0.85 100万入力

claude-sonnet-5

Claude Sonnet 5 API access for agentic coding, long-running agents, browser and computer use, professional workflows, 1M context, and up to 128K output.

DeepSeek V4 Flash
チャット

$0.112 100万入力

deepseek-v4-flash

DeepSeek V4 Flash is a fast, economical DeepSeek V4 API model with 1M-context chat, 284B total parameters, and 13B active parameters.

DeepSeek V4 Pro
チャット

$0.348 100万入力

deepseek-v4-pro

DeepSeek V4 Pro is a stronger reasoning, coding, and agent workflow model with 1M-context chat, 1.6T total parameters, and 49B active parameters.

GPT-6 Astra
チャット

$8.00 100万入力

gpt-6-astra

GPT-6 Astra API for advanced reasoning, coding, and agent workflows. Use Chat Completions or Responses with pay-as-you-go pricing on PoYo.

GPT-6 Sol
チャット

$1.60 100万入力

gpt-6-sol

GPT-6 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

Claude Fable 5.1
チャット

$8.00 100万入力

claude-fable-5-1

Anthropic's most capable generally available model for long-horizon coding, knowledge work, research, vision, 1M context, and up to 128K output.

Gemini 3.7 Flash
チャット

$0.06 100万入力

gemini-3.7-flash

Google's GA Flash model for agentic coding, multimodal reasoning, web development, long-context knowledge work, and tool-using applications.

Gemini 3.8 Flash
チャット

$0.06 100万入力

gemini-3.8-flash

Google's best reasoning and coding Flash model for long-horizon software engineering, autonomous agents, and enterprise workflows.

GPT-5.6
チャット

$0.056 100万入力

gpt-5-6-luna

GPT-5.6 API access for Sol, Terra, and Luna through the Responses API, from high-throughput automation to frontier coding and agent workflows.

GPT-6 Luna
チャット

$0.08 100万入力

gpt-6-luna

GPT-6 Luna API on PoYo. Use Chat Completions or Responses at $0.08 input and $0.4 output per million tokens, 20% below official standard rates.

Grok 4.6
チャット

$1.60 100万入力

grok-4.6

xAI's frontier model for long-running agents, coding, engineering, knowledge work, and ambitious interactive or visual projects.

Grok 4.7
チャット

$1.60 100万入力

grok-4.7

Grok 4.7 API on PoYo. Use Chat Completions at $1.6 input and $4.8 output per million tokens, 20% below official standard rates.

Claude Opus 5
チャット

$2.00 100万入力

claude-opus-5

Anthropic's flagship agentic model for advanced coding, long-horizon execution, computer use, deep research, and professional knowledge work.

Claude Opus 5.5
チャット

$3.20 100万入力

claude-opus-5-5

Claude Opus 5.5 API on PoYo. Use Chat Completions or Claude Messages at $3.2 input and $16 output per million tokens, 20% below official standard rates.

Claude Sonnet 5.5
チャット

$1.60 100万入力

claude-sonnet-5-5

Claude Sonnet 5.5 API on PoYo. Use Chat Completions or Claude Messages at $1.6 input and $8 output per million tokens, 20% below official standard rates.

DeepSeek V4.1 Flash
チャット

$0.30 100万入力

deepseek-flash

DeepSeek V4.1 Flash is a 552B MoE chat model with native vision, 1M context, 384K max output, and 8B/16B active parameters for cheaper agent workloads.

GPT-6.1 Sol
チャット

$1.60 100万入力

gpt-6.1-sol

GPT-6.1 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

GPT-5.5
チャット

$3.00 100万入力

gpt-5.5

GPT-5.5 API access for chat, coding, reasoning, and production agent workflows.

GPT-5.4
チャット

$1.05 100万入力

gpt-5.4

GPT-5.4 API access for chat, coding, reasoning, and production agent workflows.

Gemini 3.5 Flash
チャット

$0.90 100万入力

gemini-3.5-flash

Gemini 3.5 Flash API access for chat, coding, reasoning, and production agent workflows.

GPT-5.2
チャット

$0.438 100万入力

gpt-5.2

GPT-5.2 API access for chat, coding, reasoning, and production agent workflows.

Claude Opus 4.8
チャット

$4.00 100万入力

claude-opus-4-8

Claude Opus 4.8 supports long-context chat, agentic coding, professional reasoning, high-output workflows, 1M context, and up to 128K output.

Claude Opus 4.7
チャット

$4.00 100万入力

claude-opus-4-7

Anthropic's most capable generally available model for frontier coding, deep reasoning, and high-resolution vision.

Claude 4.6 API
チャット

$1.44 100万入力

claude-sonnet-4-6

Claude Sonnet 4.6 and Claude Opus 4.6 API access for coding, agents, computer use, and long-context reasoning.

Claude 4.5 Series
チャット

$0.80 100万入力

claude-opus-4-5-20251101

Anthropic's Claude 4.5 series model — Opus, Sonnet & Haiku

Gemini 3 Series
チャット

$0.40 100万入力

gemini-3-flash-preview

Google's Gemini 3 series model — Flash Preview & Pro Preview

チャットモデル API - 価格とモデル適合性

モデルを選ぶ前に、提供元、対応入力、出力形式、料金を比較してください。

正確なタスク一致

カタログメタデータに Chat が含まれるモデルだけがここに表示されます。

プロバイダー比較

タスクディレクトリから離れずに、複数プロバイダーのモデルファミリーを比較できます。

API対応の導線

各モデルカードから PoYo の価格、例、Playground、API詳細へ移動できます。

モデルプロバイダータスクタイプ価格
Kimi K3

kimi-k3

Moonshot AIChat$2.28100万入力
Claude Sonnet 5

claude-sonnet-5

AnthropicChat$0.85100万入力
DeepSeek V4 Flash

deepseek-v4-flash

DeepSeekChat$0.112100万入力
DeepSeek V4 Pro

deepseek-v4-pro

DeepSeekChat$0.348100万入力
GPT-6 Astra

gpt-6-astra

OpenAIChat$8.00100万入力
GPT-6 Sol

gpt-6-sol

OpenAIChat$1.60100万入力
Claude Fable 5.1

claude-fable-5-1

AnthropicChat$8.00100万入力
Gemini 3.7 Flash

gemini-3.7-flash

GoogleChat$0.06100万入力
Gemini 3.8 Flash

gemini-3.8-flash

GoogleChat$0.06100万入力
GPT-5.6

gpt-5-6-luna

OpenAIChat$0.056100万入力
GPT-6 Luna

gpt-6-luna

OpenAIChat$0.08100万入力
Grok 4.6

grok-4.6

xAIChat$1.60100万入力
Grok 4.7

grok-4.7

xAIChat$1.60100万入力
Claude Opus 5

claude-opus-5

AnthropicChat$2.00100万入力
Claude Opus 5.5

claude-opus-5-5

AnthropicChat$3.20100万入力
Claude Sonnet 5.5

claude-sonnet-5-5

AnthropicChat$1.60100万入力
DeepSeek V4.1 Flash

deepseek-flash

DeepSeekChat$0.30100万入力
GPT-6.1 Sol

gpt-6.1-sol

OpenAIChat$1.60100万入力
GPT-5.5

gpt-5.5

OpenAIChat$3.00100万入力
GPT-5.4

gpt-5.4

OpenAIChat$1.05100万入力
Gemini 3.5 Flash

gemini-3.5-flash

GoogleChat$0.90100万入力
GPT-5.2

gpt-5.2

OpenAIChat$0.438100万入力
Claude Opus 4.8

claude-opus-4-8

AnthropicChat$4.00100万入力
Claude Opus 4.7

claude-opus-4-7

AnthropicChat$4.00100万入力
Claude 4.6 API

claude-sonnet-4-6

AnthropicChat$1.44100万入力
Claude 4.5 Series

claude-opus-4-5-20251101

AnthropicChat$0.80100万入力
Gemini 3 Series

gemini-3-flash-preview

GoogleChat$0.40100万入力

よくある質問

AIチャットAPIとは何ですか?

+

AI チャット API は会話メッセージを受け入れ、言語モデルの応答を返します。これにより、独自のアプリケーションで記述、推論、コーディング、およびアシスタント機能が可能になります。利用可能な入力タイプとコントロールは、選択したモデルと API プロトコルによって異なります。

どの LLM API モデルを選択すればよいですか?

+

製品が使用するプロンプト、会話の長さ、出力を使用してモデルを評価します。回答の質、指示のフォロー、速度、トークンのコストを比較します。印象的な回答を 1 つ選択するのではなく、困難な例や失敗した例も評価に含めてください。

すべての PoYo チャット モデルは同じリクエスト形式を使用しますか?

+

いいえ。モデルのドキュメントを使用して、OpenAI 互換のチャット補完、Claude Messages または Gemini ネイティブ形式を選択します。メッセージ構造、認証の詳細、サポートされるコントロールは異なる場合があります。モデル名のみを変更するのではなく、文書化されたプロトコルにリクエストを適合させます。

マルチターンの会話コンテキストを保存するにはどうすればよいですか?

+

関連メッセージをアプリケーションに保存し、選択したプロトコルで必要な履歴を送信します。モデルのコンテキストの制限内に保ち、タスクに役に立たなくなった内容を削除または要約します。新しい API リクエストは、以前のリクエストを自動的に記憶すると想定すべきではありません。

AI チャット API はストリーミング応答をサポートしていますか?

+

選択したモデルとエンドポイントのストリーミング サポートとリクエスト オプションを確認します。利用可能な場合は、クライアントで部分的なイベント、完了、エラーを処理します。ワークフローが検証またはダウンストリーム処理の前に完全な応答を必要とする場合は、非ストリーミング パスを維持します。

画像やその他のメディアをチャット モデルに送信できますか?

+

そのモデルについて文書化されたメディア タイプとメッセージ構造のみを使用します。 LLM エンドポイントの中にはテキストのみを使用できるものと、マルチモーダル入力をサポートするものがあります。アップロードを実装する前にサイズ、形式、コンテンツの制限を確認し、モデルが実際のメディアをどの程度適切に処理するかをテストしてください。

JSON またはその他の構造化された応答をリクエストできますか?

+

一部のモデルは構造化された出力コントロールを公開します。他のものはプロンプトによってのみガイドできます。サポートされているメカニズムを確認し、利用可能な場合は明確なスキーマを提供し、アプリケーションで返されたデータを検証します。 JSON のリクエストを、すべてのレスポンスがスキーマを満たすことを証明するものとして扱わないでください。

チャット モデルは自動的に Web を閲覧したり、ツールを呼び出したりできますか?

+

エンドポイントが機能をサポートしており、アプリケーションが必要なツールを提供または有効にしている場合のみ。モデルは、ツール呼び出しを実行せずに記述することができます。文書化されたツール プロトコルを確認し、統合における実行、権限、および結果の処理を明示的に保ちます。

AI チャットの不正確な回答を減らすにはどうすればよいですか?

+

関連するソース資料を提供し、タスクを正確にし、不足している情報と既知の事実を区別するようにモデルに依頼します。重要な出力を信頼できるデータと照合して検証し、繰り返し発生する失敗ケースをテストします。モデルの選択とプロンプトは品質を向上させることができますが、生成された回答は依然として適切なレビューが必要です。

AI チャット API の価格はどのように計算されますか?

+

チャットの価格設定は通常、入力トークンと出力トークンを分離しており、一部のモデルには追加の層の区別があります。選択したモデルの価格と使用状況の応答を確認します。長いコンテキストを繰り返し送信すると各ターンのコストが増加する可能性があるため、見積もりには会話履歴を含めてください。

コンテキスト エラー、レート制限、タイムアウトについてはどうすればよいですか?

+

返されたエラーと選択したモデルの制限を確認してください。サイズが大きすぎるコンテキストを削減し、同時リクエストを制御し、必要に応じて制限された再試行を使用します。部分的なストリーミング応答の場合は、受信した内容を記録し、会話ターンを黙って複製するのではなく、アプリケーションがどのように回復するかを決定します。

AI チャット API の統合例はどこで見つかりますか?

+

モデル ページとその API ドキュメントを開いて、正しいエンドポイント、認証、メッセージ本文、および例を確認します。モデル固有の llms.txt リソースもプロトコルを識別します。キーをサーバー上に保持し、自動化されたビジネス アクションで使用する前に出力を検証します。