API de chat IA

API IA pour les développeurs

API de chat IA

Créez des fonctionnalités d'écriture, de raisonnement et de codage avec l'API de chat IA PoYo. Comparez les modèles LLM, les protocoles de conversation, les entrées prises en charge, les contrôles de réponse et la tarification des jetons.

Modèles compatibles

27 modèles

Kimi K3
Chat

$2.28 1 M entrée

kimi-k3

Moonshot AI's 2.8T-parameter flagship multimodal model with a 1M-token context window, built for long-horizon coding, deep reasoning, knowledge work, and tool-using agents.

Claude Sonnet 5
Chat

$0.85 1 M entrée

claude-sonnet-5

Claude Sonnet 5 API access for agentic coding, long-running agents, browser and computer use, professional workflows, 1M context, and up to 128K output.

DeepSeek V4 Flash
Chat

$0.112 1 M entrée

deepseek-v4-flash

DeepSeek V4 Flash is a fast, economical DeepSeek V4 API model with 1M-context chat, 284B total parameters, and 13B active parameters.

DeepSeek V4 Pro
Chat

$0.348 1 M entrée

deepseek-v4-pro

DeepSeek V4 Pro is a stronger reasoning, coding, and agent workflow model with 1M-context chat, 1.6T total parameters, and 49B active parameters.

GPT-6 Astra
Chat

$8.00 1 M entrée

gpt-6-astra

GPT-6 Astra API for advanced reasoning, coding, and agent workflows. Use Chat Completions or Responses with pay-as-you-go pricing on PoYo.

GPT-6 Sol
Chat

$1.60 1 M entrée

gpt-6-sol

GPT-6 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

Claude Fable 5.1
Chat

$8.00 1 M entrée

claude-fable-5-1

Anthropic's most capable generally available model for long-horizon coding, knowledge work, research, vision, 1M context, and up to 128K output.

Gemini 3.7 Flash
Chat

$0.06 1 M entrée

gemini-3.7-flash

Google's GA Flash model for agentic coding, multimodal reasoning, web development, long-context knowledge work, and tool-using applications.

Gemini 3.8 Flash
Chat

$0.06 1 M entrée

gemini-3.8-flash

Google's best reasoning and coding Flash model for long-horizon software engineering, autonomous agents, and enterprise workflows.

GPT-5.6
Chat

$0.056 1 M entrée

gpt-5-6-luna

GPT-5.6 API access for Sol, Terra, and Luna through the Responses API, from high-throughput automation to frontier coding and agent workflows.

GPT-6 Luna
Chat

$0.08 1 M entrée

gpt-6-luna

GPT-6 Luna API on PoYo. Use Chat Completions or Responses at $0.08 input and $0.4 output per million tokens, 20% below official standard rates.

Grok 4.6
Chat

$1.60 1 M entrée

grok-4.6

xAI's frontier model for long-running agents, coding, engineering, knowledge work, and ambitious interactive or visual projects.

Grok 4.7
Chat

$1.60 1 M entrée

grok-4.7

Grok 4.7 API on PoYo. Use Chat Completions at $1.6 input and $4.8 output per million tokens, 20% below official standard rates.

Claude Opus 5
Chat

$2.00 1 M entrée

claude-opus-5

Anthropic's flagship agentic model for advanced coding, long-horizon execution, computer use, deep research, and professional knowledge work.

Claude Opus 5.5
Chat

$3.20 1 M entrée

claude-opus-5-5

Claude Opus 5.5 API on PoYo. Use Chat Completions or Claude Messages at $3.2 input and $16 output per million tokens, 20% below official standard rates.

Claude Sonnet 5.5
Chat

$1.60 1 M entrée

claude-sonnet-5-5

Claude Sonnet 5.5 API on PoYo. Use Chat Completions or Claude Messages at $1.6 input and $8 output per million tokens, 20% below official standard rates.

DeepSeek V4.1 Flash
Chat

$0.30 1 M entrée

deepseek-flash

DeepSeek V4.1 Flash is a 552B MoE chat model with native vision, 1M context, 384K max output, and 8B/16B active parameters for cheaper agent workloads.

GPT-6.1 Sol
Chat

$1.60 1 M entrée

gpt-6.1-sol

GPT-6.1 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

GPT-5.5
Chat

$3.00 1 M entrée

gpt-5.5

GPT-5.5 API access for chat, coding, reasoning, and production agent workflows.

GPT-5.4
Chat

$1.05 1 M entrée

gpt-5.4

GPT-5.4 API access for chat, coding, reasoning, and production agent workflows.

Gemini 3.5 Flash
Chat

$0.90 1 M entrée

gemini-3.5-flash

Gemini 3.5 Flash API access for chat, coding, reasoning, and production agent workflows.

GPT-5.2
Chat

$0.438 1 M entrée

gpt-5.2

GPT-5.2 API access for chat, coding, reasoning, and production agent workflows.

Claude Opus 4.8
Chat

$4.00 1 M entrée

claude-opus-4-8

Claude Opus 4.8 supports long-context chat, agentic coding, professional reasoning, high-output workflows, 1M context, and up to 128K output.

Claude Opus 4.7
Chat

$4.00 1 M entrée

claude-opus-4-7

Anthropic's most capable generally available model for frontier coding, deep reasoning, and high-resolution vision.

Claude 4.6 API
Chat

$1.44 1 M entrée

claude-sonnet-4-6

Claude Sonnet 4.6 and Claude Opus 4.6 API access for coding, agents, computer use, and long-context reasoning.

Claude 4.5 Series
Chat

$0.80 1 M entrée

claude-opus-4-5-20251101

Anthropic's Claude 4.5 series model — Opus, Sonnet & Haiku

Gemini 3 Series
Chat

$0.40 1 M entrée

gemini-3-flash-preview

Google's Gemini 3 series model — Flash Preview & Pro Preview

API de modèles Chat - Prix et adéquation

Comparez les fournisseurs, les entrées acceptées, les formats de sortie et les tarifs avant de choisir.

Correspondance exacte

Les modèles apparaissent ici uniquement lorsque leurs métadonnées de catalogue incluent Chat.

Comparaison des fournisseurs

Comparez les familles de modèles de plusieurs fournisseurs sans quitter ce répertoire de tâches.

Parcours prêts pour l'API

Chaque carte de modèle mène aux prix PoYo, aux exemples, au playground et aux détails API.

ModèleFournisseurTypes de tâchesPrix
Kimi K3

kimi-k3

Moonshot AIChat$2.281 M entrée
Claude Sonnet 5

claude-sonnet-5

AnthropicChat$0.851 M entrée
DeepSeek V4 Flash

deepseek-v4-flash

DeepSeekChat$0.1121 M entrée
DeepSeek V4 Pro

deepseek-v4-pro

DeepSeekChat$0.3481 M entrée
GPT-6 Astra

gpt-6-astra

OpenAIChat$8.001 M entrée
GPT-6 Sol

gpt-6-sol

OpenAIChat$1.601 M entrée
Claude Fable 5.1

claude-fable-5-1

AnthropicChat$8.001 M entrée
Gemini 3.7 Flash

gemini-3.7-flash

GoogleChat$0.061 M entrée
Gemini 3.8 Flash

gemini-3.8-flash

GoogleChat$0.061 M entrée
GPT-5.6

gpt-5-6-luna

OpenAIChat$0.0561 M entrée
GPT-6 Luna

gpt-6-luna

OpenAIChat$0.081 M entrée
Grok 4.6

grok-4.6

xAIChat$1.601 M entrée
Grok 4.7

grok-4.7

xAIChat$1.601 M entrée
Claude Opus 5

claude-opus-5

AnthropicChat$2.001 M entrée
Claude Opus 5.5

claude-opus-5-5

AnthropicChat$3.201 M entrée
Claude Sonnet 5.5

claude-sonnet-5-5

AnthropicChat$1.601 M entrée
DeepSeek V4.1 Flash

deepseek-flash

DeepSeekChat$0.301 M entrée
GPT-6.1 Sol

gpt-6.1-sol

OpenAIChat$1.601 M entrée
GPT-5.5

gpt-5.5

OpenAIChat$3.001 M entrée
GPT-5.4

gpt-5.4

OpenAIChat$1.051 M entrée
Gemini 3.5 Flash

gemini-3.5-flash

GoogleChat$0.901 M entrée
GPT-5.2

gpt-5.2

OpenAIChat$0.4381 M entrée
Claude Opus 4.8

claude-opus-4-8

AnthropicChat$4.001 M entrée
Claude Opus 4.7

claude-opus-4-7

AnthropicChat$4.001 M entrée
Claude 4.6 API

claude-sonnet-4-6

AnthropicChat$1.441 M entrée
Claude 4.5 Series

claude-opus-4-5-20251101

AnthropicChat$0.801 M entrée
Gemini 3 Series

gemini-3-flash-preview

GoogleChat$0.401 M entrée

Questions fréquentes

Qu’est-ce que l’API de chat IA ?

+

Une API de chat IA accepte les messages de conversation et renvoie une réponse de modèle de langage. Il permet d'écrire, de raisonner, de coder et d'assister des fonctionnalités dans votre propre application. Les types d'entrée et les contrôles disponibles dépendent du modèle sélectionné et du protocole API.

Quel modèle d'API LLM dois-je choisir ?

+

Évaluez les modèles avec les invites, la durée des conversations et les résultats utilisés par votre produit. Comparez la qualité des réponses, le suivi des instructions, la vitesse et le coût des jetons. Incluez des exemples difficiles et infructueux dans l’évaluation plutôt que de choisir parmi une réponse impressionnante.

Tous les modèles de discussion PoYo utilisent-ils le même format de requête ?

+

Non. Utilisez la documentation du modèle pour choisir les complétions de conversation compatibles OpenAI, le format natif Claude Messages ou Gemini. Les structures des messages, les détails d'authentification et les contrôles pris en charge peuvent différer. Adaptez la requête au protocole documenté au lieu de changer uniquement le nom du modèle.

Comment préserver le contexte de conversation à plusieurs tours ?

+

Stockez les messages pertinents dans votre application et envoyez l'historique requis par le protocole sélectionné. Restez dans la limite du contexte du modèle et supprimez ou résumez les éléments qui ne facilitent plus la tâche. Il ne faut pas supposer qu’une nouvelle requête API mémorise automatiquement les requêtes antérieures.

L'API de chat IA prend-elle en charge les réponses en streaming ?

+

Vérifiez la prise en charge du streaming et les options de demande pour le modèle et le point de terminaison choisis. Si disponible, gérez les événements partiels, l'achèvement et les erreurs dans votre client. Conservez un chemin sans flux lorsque votre flux de travail nécessite une réponse complète avant la validation ou le traitement en aval.

Puis-je envoyer des images ou d'autres médias à un modèle de discussion ?

+

Utilisez uniquement les types de médias et les structures de messages documentés pour ce modèle. Certains points de terminaison LLM contiennent uniquement du texte et d'autres prennent en charge les entrées multimodales. Vérifiez les limitations de taille, de format et de contenu avant de mettre en œuvre les téléchargements, et testez dans quelle mesure le modèle gère vos médias réels.

Puis-je demander JSON ou une autre réponse structurée ?

+

Certains modèles exposent des contrôles de sortie structurés ; d'autres ne peuvent être guidés que par des invites. Confirmez le mécanisme pris en charge, fournissez un schéma clair le cas échéant et validez les données renvoyées dans votre application. Ne considérez pas une requête JSON comme une preuve que chaque réponse satisfera votre schéma.

Un modèle de chat peut-il naviguer sur le Web ou appeler des outils automatiquement ?

+

Uniquement lorsque le point de terminaison prend en charge la fonctionnalité et que votre application fournit ou active les outils requis. Un modèle peut décrire un appel d'outil sans l'exécuter. Vérifiez le protocole de l'outil documenté et gardez l'exécution, les autorisations et la gestion des résultats explicites dans votre intégration.

Comment puis-je réduire les réponses inexactes au chat IA ?

+

Fournissez des sources pertinentes, précisez la tâche et demandez au modèle de distinguer les informations manquantes des faits connus. Validez les résultats importants par rapport à des données fiables et testez les cas de défaillance récurrents. Le choix du modèle et les incitations peuvent améliorer la qualité, mais les réponses générées nécessitent toujours un examen approprié.

Comment le prix de l'API de chat IA est-il calculé ?

+

La tarification du chat sépare généralement les jetons d'entrée et de sortie, et certains modèles ont des distinctions de niveau supplémentaires. Lisez la tarification du modèle sélectionné et la réponse à l'utilisation. Incluez l’historique des conversations dans votre estimation, car l’envoi répété d’un long contexte peut augmenter le coût de chaque tour.

Que dois-je faire en cas d'erreurs de contexte, de limites de débit ou de délais d'attente ?

+

Vérifiez l'erreur renvoyée et les limites du modèle sélectionné. Réduisez le contexte surdimensionné, contrôlez les requêtes simultanées et utilisez des tentatives limitées le cas échéant. Pour une réponse en streaming partielle, enregistrez ce qui a été reçu et décidez comment votre application doit récupérer au lieu de dupliquer silencieusement un tour de conversation.

Où puis-je trouver des exemples d'intégration d'API de chat IA ?

+

Ouvrez la page de modèle et sa documentation API pour connaître le point de terminaison, l'authentification, le corps du message et les exemples corrects. La ressource llms.txt spécifique au modèle identifie également le protocole. Conservez les clés sur le serveur et validez les sorties avant de les utiliser dans des actions commerciales automatisées.