
開発者向けの AI API
AIチャットAPI
PoYo AI チャット API を使用して、書き込み、推論、コーディング機能を構築します。 LLM モデル、会話プロトコル、サポートされている入力、応答制御、トークン価格を比較します。
対応モデル
27 個のモデル

$2.28 100万入力
kimi-k3
Moonshot AI's 2.8T-parameter flagship multimodal model with a 1M-token context window, built for long-horizon coding, deep reasoning, knowledge work, and tool-using agents.

$0.85 100万入力
claude-sonnet-5
Claude Sonnet 5 API access for agentic coding, long-running agents, browser and computer use, professional workflows, 1M context, and up to 128K output.

$0.112 100万入力
deepseek-v4-flash
DeepSeek V4 Flash is a fast, economical DeepSeek V4 API model with 1M-context chat, 284B total parameters, and 13B active parameters.

$0.348 100万入力
deepseek-v4-pro
DeepSeek V4 Pro is a stronger reasoning, coding, and agent workflow model with 1M-context chat, 1.6T total parameters, and 49B active parameters.

$8.00 100万入力
gpt-6-astra
GPT-6 Astra API for advanced reasoning, coding, and agent workflows. Use Chat Completions or Responses with pay-as-you-go pricing on PoYo.

$1.60 100万入力
gpt-6-sol
GPT-6 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$8.00 100万入力
claude-fable-5-1
Anthropic's most capable generally available model for long-horizon coding, knowledge work, research, vision, 1M context, and up to 128K output.

$0.06 100万入力
gemini-3.7-flash
Google's GA Flash model for agentic coding, multimodal reasoning, web development, long-context knowledge work, and tool-using applications.

$0.06 100万入力
gemini-3.8-flash
Google's best reasoning and coding Flash model for long-horizon software engineering, autonomous agents, and enterprise workflows.

$0.056 100万入力
gpt-5-6-luna
GPT-5.6 API access for Sol, Terra, and Luna through the Responses API, from high-throughput automation to frontier coding and agent workflows.

$0.08 100万入力
gpt-6-luna
GPT-6 Luna API on PoYo. Use Chat Completions or Responses at $0.08 input and $0.4 output per million tokens, 20% below official standard rates.

$1.60 100万入力
grok-4.6
xAI's frontier model for long-running agents, coding, engineering, knowledge work, and ambitious interactive or visual projects.

$1.60 100万入力
grok-4.7
Grok 4.7 API on PoYo. Use Chat Completions at $1.6 input and $4.8 output per million tokens, 20% below official standard rates.

$2.00 100万入力
claude-opus-5
Anthropic's flagship agentic model for advanced coding, long-horizon execution, computer use, deep research, and professional knowledge work.

$3.20 100万入力
claude-opus-5-5
Claude Opus 5.5 API on PoYo. Use Chat Completions or Claude Messages at $3.2 input and $16 output per million tokens, 20% below official standard rates.

$1.60 100万入力
claude-sonnet-5-5
Claude Sonnet 5.5 API on PoYo. Use Chat Completions or Claude Messages at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$0.30 100万入力
deepseek-flash
DeepSeek V4.1 Flash is a 552B MoE chat model with native vision, 1M context, 384K max output, and 8B/16B active parameters for cheaper agent workloads.

$1.60 100万入力
gpt-6.1-sol
GPT-6.1 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$3.00 100万入力
gpt-5.5
GPT-5.5 API access for chat, coding, reasoning, and production agent workflows.

$1.05 100万入力
gpt-5.4
GPT-5.4 API access for chat, coding, reasoning, and production agent workflows.

$0.90 100万入力
gemini-3.5-flash
Gemini 3.5 Flash API access for chat, coding, reasoning, and production agent workflows.

$0.438 100万入力
gpt-5.2
GPT-5.2 API access for chat, coding, reasoning, and production agent workflows.

$4.00 100万入力
claude-opus-4-8
Claude Opus 4.8 supports long-context chat, agentic coding, professional reasoning, high-output workflows, 1M context, and up to 128K output.

$4.00 100万入力
claude-opus-4-7
Anthropic's most capable generally available model for frontier coding, deep reasoning, and high-resolution vision.

$1.44 100万入力
claude-sonnet-4-6
Claude Sonnet 4.6 and Claude Opus 4.6 API access for coding, agents, computer use, and long-context reasoning.

$0.80 100万入力
claude-opus-4-5-20251101
Anthropic's Claude 4.5 series model — Opus, Sonnet & Haiku

$0.40 100万入力
gemini-3-flash-preview
Google's Gemini 3 series model — Flash Preview & Pro Preview
チャットモデル API - 価格とモデル適合性
モデルを選ぶ前に、提供元、対応入力、出力形式、料金を比較してください。
正確なタスク一致
カタログメタデータに Chat が含まれるモデルだけがここに表示されます。
プロバイダー比較
タスクディレクトリから離れずに、複数プロバイダーのモデルファミリーを比較できます。
API対応の導線
各モデルカードから PoYo の価格、例、Playground、API詳細へ移動できます。
| モデル | プロバイダー | タスクタイプ | 価格 |
|---|---|---|---|
| Kimi K3 kimi-k3 | Moonshot AI | Chat | $2.28100万入力 |
| Claude Sonnet 5 claude-sonnet-5 | Anthropic | Chat | $0.85100万入力 |
| DeepSeek V4 Flash deepseek-v4-flash | DeepSeek | Chat | $0.112100万入力 |
| DeepSeek V4 Pro deepseek-v4-pro | DeepSeek | Chat | $0.348100万入力 |
| GPT-6 Astra gpt-6-astra | OpenAI | Chat | $8.00100万入力 |
| GPT-6 Sol gpt-6-sol | OpenAI | Chat | $1.60100万入力 |
| Claude Fable 5.1 claude-fable-5-1 | Anthropic | Chat | $8.00100万入力 |
| Gemini 3.7 Flash gemini-3.7-flash | Chat | $0.06100万入力 | |
| Gemini 3.8 Flash gemini-3.8-flash | Chat | $0.06100万入力 | |
| GPT-5.6 gpt-5-6-luna | OpenAI | Chat | $0.056100万入力 |
| GPT-6 Luna gpt-6-luna | OpenAI | Chat | $0.08100万入力 |
| Grok 4.6 grok-4.6 | xAI | Chat | $1.60100万入力 |
| Grok 4.7 grok-4.7 | xAI | Chat | $1.60100万入力 |
| Claude Opus 5 claude-opus-5 | Anthropic | Chat | $2.00100万入力 |
| Claude Opus 5.5 claude-opus-5-5 | Anthropic | Chat | $3.20100万入力 |
| Claude Sonnet 5.5 claude-sonnet-5-5 | Anthropic | Chat | $1.60100万入力 |
| DeepSeek V4.1 Flash deepseek-flash | DeepSeek | Chat | $0.30100万入力 |
| GPT-6.1 Sol gpt-6.1-sol | OpenAI | Chat | $1.60100万入力 |
| GPT-5.5 gpt-5.5 | OpenAI | Chat | $3.00100万入力 |
| GPT-5.4 gpt-5.4 | OpenAI | Chat | $1.05100万入力 |
| Gemini 3.5 Flash gemini-3.5-flash | Chat | $0.90100万入力 | |
| GPT-5.2 gpt-5.2 | OpenAI | Chat | $0.438100万入力 |
| Claude Opus 4.8 claude-opus-4-8 | Anthropic | Chat | $4.00100万入力 |
| Claude Opus 4.7 claude-opus-4-7 | Anthropic | Chat | $4.00100万入力 |
| Claude 4.6 API claude-sonnet-4-6 | Anthropic | Chat | $1.44100万入力 |
| Claude 4.5 Series claude-opus-4-5-20251101 | Anthropic | Chat | $0.80100万入力 |
| Gemini 3 Series gemini-3-flash-preview | Chat | $0.40100万入力 |
よくある質問
AIチャットAPIとは何ですか?
+
AI チャット API は会話メッセージを受け入れ、言語モデルの応答を返します。これにより、独自のアプリケーションで記述、推論、コーディング、およびアシスタント機能が可能になります。利用可能な入力タイプとコントロールは、選択したモデルと API プロトコルによって異なります。
どの LLM API モデルを選択すればよいですか?
+
製品が使用するプロンプト、会話の長さ、出力を使用してモデルを評価します。回答の質、指示のフォロー、速度、トークンのコストを比較します。印象的な回答を 1 つ選択するのではなく、困難な例や失敗した例も評価に含めてください。
すべての PoYo チャット モデルは同じリクエスト形式を使用しますか?
+
いいえ。モデルのドキュメントを使用して、OpenAI 互換のチャット補完、Claude Messages または Gemini ネイティブ形式を選択します。メッセージ構造、認証の詳細、サポートされるコントロールは異なる場合があります。モデル名のみを変更するのではなく、文書化されたプロトコルにリクエストを適合させます。
マルチターンの会話コンテキストを保存するにはどうすればよいですか?
+
関連メッセージをアプリケーションに保存し、選択したプロトコルで必要な履歴を送信します。モデルのコンテキストの制限内に保ち、タスクに役に立たなくなった内容を削除または要約します。新しい API リクエストは、以前のリクエストを自動的に記憶すると想定すべきではありません。
AI チャット API はストリーミング応答をサポートしていますか?
+
選択したモデルとエンドポイントのストリーミング サポートとリクエスト オプションを確認します。利用可能な場合は、クライアントで部分的なイベント、完了、エラーを処理します。ワークフローが検証またはダウンストリーム処理の前に完全な応答を必要とする場合は、非ストリーミング パスを維持します。
画像やその他のメディアをチャット モデルに送信できますか?
+
そのモデルについて文書化されたメディア タイプとメッセージ構造のみを使用します。 LLM エンドポイントの中にはテキストのみを使用できるものと、マルチモーダル入力をサポートするものがあります。アップロードを実装する前にサイズ、形式、コンテンツの制限を確認し、モデルが実際のメディアをどの程度適切に処理するかをテストしてください。
JSON またはその他の構造化された応答をリクエストできますか?
+
一部のモデルは構造化された出力コントロールを公開します。他のものはプロンプトによってのみガイドできます。サポートされているメカニズムを確認し、利用可能な場合は明確なスキーマを提供し、アプリケーションで返されたデータを検証します。 JSON のリクエストを、すべてのレスポンスがスキーマを満たすことを証明するものとして扱わないでください。
チャット モデルは自動的に Web を閲覧したり、ツールを呼び出したりできますか?
+
エンドポイントが機能をサポートしており、アプリケーションが必要なツールを提供または有効にしている場合のみ。モデルは、ツール呼び出しを実行せずに記述することができます。文書化されたツール プロトコルを確認し、統合における実行、権限、および結果の処理を明示的に保ちます。
AI チャットの不正確な回答を減らすにはどうすればよいですか?
+
関連するソース資料を提供し、タスクを正確にし、不足している情報と既知の事実を区別するようにモデルに依頼します。重要な出力を信頼できるデータと照合して検証し、繰り返し発生する失敗ケースをテストします。モデルの選択とプロンプトは品質を向上させることができますが、生成された回答は依然として適切なレビューが必要です。
AI チャット API の価格はどのように計算されますか?
+
チャットの価格設定は通常、入力トークンと出力トークンを分離しており、一部のモデルには追加の層の区別があります。選択したモデルの価格と使用状況の応答を確認します。長いコンテキストを繰り返し送信すると各ターンのコストが増加する可能性があるため、見積もりには会話履歴を含めてください。
コンテキスト エラー、レート制限、タイムアウトについてはどうすればよいですか?
+
返されたエラーと選択したモデルの制限を確認してください。サイズが大きすぎるコンテキストを削減し、同時リクエストを制御し、必要に応じて制限された再試行を使用します。部分的なストリーミング応答の場合は、受信した内容を記録し、会話ターンを黙って複製するのではなく、アプリケーションがどのように回復するかを決定します。
AI チャット API の統合例はどこで見つかりますか?
+
モデル ページとその API ドキュメントを開いて、正しいエンドポイント、認証、メッセージ本文、および例を確認します。モデル固有の llms.txt リソースもプロトコルを識別します。キーをサーバー上に保持し、自動化されたビジネス アクションで使用する前に出力を検証します。