
API IA pour les développeurs
API de chat IA
Créez des fonctionnalités d'écriture, de raisonnement et de codage avec l'API de chat IA PoYo. Comparez les modèles LLM, les protocoles de conversation, les entrées prises en charge, les contrôles de réponse et la tarification des jetons.
Modèles compatibles
27 modèles

$2.28 1 M entrée
kimi-k3
Moonshot AI's 2.8T-parameter flagship multimodal model with a 1M-token context window, built for long-horizon coding, deep reasoning, knowledge work, and tool-using agents.

$0.85 1 M entrée
claude-sonnet-5
Claude Sonnet 5 API access for agentic coding, long-running agents, browser and computer use, professional workflows, 1M context, and up to 128K output.

$0.112 1 M entrée
deepseek-v4-flash
DeepSeek V4 Flash is a fast, economical DeepSeek V4 API model with 1M-context chat, 284B total parameters, and 13B active parameters.

$0.348 1 M entrée
deepseek-v4-pro
DeepSeek V4 Pro is a stronger reasoning, coding, and agent workflow model with 1M-context chat, 1.6T total parameters, and 49B active parameters.

$8.00 1 M entrée
gpt-6-astra
GPT-6 Astra API for advanced reasoning, coding, and agent workflows. Use Chat Completions or Responses with pay-as-you-go pricing on PoYo.

$1.60 1 M entrée
gpt-6-sol
GPT-6 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$8.00 1 M entrée
claude-fable-5-1
Anthropic's most capable generally available model for long-horizon coding, knowledge work, research, vision, 1M context, and up to 128K output.

$0.06 1 M entrée
gemini-3.7-flash
Google's GA Flash model for agentic coding, multimodal reasoning, web development, long-context knowledge work, and tool-using applications.

$0.06 1 M entrée
gemini-3.8-flash
Google's best reasoning and coding Flash model for long-horizon software engineering, autonomous agents, and enterprise workflows.

$0.056 1 M entrée
gpt-5-6-luna
GPT-5.6 API access for Sol, Terra, and Luna through the Responses API, from high-throughput automation to frontier coding and agent workflows.

$0.08 1 M entrée
gpt-6-luna
GPT-6 Luna API on PoYo. Use Chat Completions or Responses at $0.08 input and $0.4 output per million tokens, 20% below official standard rates.

$1.60 1 M entrée
grok-4.6
xAI's frontier model for long-running agents, coding, engineering, knowledge work, and ambitious interactive or visual projects.

$1.60 1 M entrée
grok-4.7
Grok 4.7 API on PoYo. Use Chat Completions at $1.6 input and $4.8 output per million tokens, 20% below official standard rates.

$2.00 1 M entrée
claude-opus-5
Anthropic's flagship agentic model for advanced coding, long-horizon execution, computer use, deep research, and professional knowledge work.

$3.20 1 M entrée
claude-opus-5-5
Claude Opus 5.5 API on PoYo. Use Chat Completions or Claude Messages at $3.2 input and $16 output per million tokens, 20% below official standard rates.

$1.60 1 M entrée
claude-sonnet-5-5
Claude Sonnet 5.5 API on PoYo. Use Chat Completions or Claude Messages at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$0.30 1 M entrée
deepseek-flash
DeepSeek V4.1 Flash is a 552B MoE chat model with native vision, 1M context, 384K max output, and 8B/16B active parameters for cheaper agent workloads.

$1.60 1 M entrée
gpt-6.1-sol
GPT-6.1 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$3.00 1 M entrée
gpt-5.5
GPT-5.5 API access for chat, coding, reasoning, and production agent workflows.

$1.05 1 M entrée
gpt-5.4
GPT-5.4 API access for chat, coding, reasoning, and production agent workflows.

$0.90 1 M entrée
gemini-3.5-flash
Gemini 3.5 Flash API access for chat, coding, reasoning, and production agent workflows.

$0.438 1 M entrée
gpt-5.2
GPT-5.2 API access for chat, coding, reasoning, and production agent workflows.

$4.00 1 M entrée
claude-opus-4-8
Claude Opus 4.8 supports long-context chat, agentic coding, professional reasoning, high-output workflows, 1M context, and up to 128K output.

$4.00 1 M entrée
claude-opus-4-7
Anthropic's most capable generally available model for frontier coding, deep reasoning, and high-resolution vision.

$1.44 1 M entrée
claude-sonnet-4-6
Claude Sonnet 4.6 and Claude Opus 4.6 API access for coding, agents, computer use, and long-context reasoning.

$0.80 1 M entrée
claude-opus-4-5-20251101
Anthropic's Claude 4.5 series model — Opus, Sonnet & Haiku

$0.40 1 M entrée
gemini-3-flash-preview
Google's Gemini 3 series model — Flash Preview & Pro Preview
API de modèles Chat - Prix et adéquation
Comparez les fournisseurs, les entrées acceptées, les formats de sortie et les tarifs avant de choisir.
Correspondance exacte
Les modèles apparaissent ici uniquement lorsque leurs métadonnées de catalogue incluent Chat.
Comparaison des fournisseurs
Comparez les familles de modèles de plusieurs fournisseurs sans quitter ce répertoire de tâches.
Parcours prêts pour l'API
Chaque carte de modèle mène aux prix PoYo, aux exemples, au playground et aux détails API.
| Modèle | Fournisseur | Types de tâches | Prix |
|---|---|---|---|
| Kimi K3 kimi-k3 | Moonshot AI | Chat | $2.281 M entrée |
| Claude Sonnet 5 claude-sonnet-5 | Anthropic | Chat | $0.851 M entrée |
| DeepSeek V4 Flash deepseek-v4-flash | DeepSeek | Chat | $0.1121 M entrée |
| DeepSeek V4 Pro deepseek-v4-pro | DeepSeek | Chat | $0.3481 M entrée |
| GPT-6 Astra gpt-6-astra | OpenAI | Chat | $8.001 M entrée |
| GPT-6 Sol gpt-6-sol | OpenAI | Chat | $1.601 M entrée |
| Claude Fable 5.1 claude-fable-5-1 | Anthropic | Chat | $8.001 M entrée |
| Gemini 3.7 Flash gemini-3.7-flash | Chat | $0.061 M entrée | |
| Gemini 3.8 Flash gemini-3.8-flash | Chat | $0.061 M entrée | |
| GPT-5.6 gpt-5-6-luna | OpenAI | Chat | $0.0561 M entrée |
| GPT-6 Luna gpt-6-luna | OpenAI | Chat | $0.081 M entrée |
| Grok 4.6 grok-4.6 | xAI | Chat | $1.601 M entrée |
| Grok 4.7 grok-4.7 | xAI | Chat | $1.601 M entrée |
| Claude Opus 5 claude-opus-5 | Anthropic | Chat | $2.001 M entrée |
| Claude Opus 5.5 claude-opus-5-5 | Anthropic | Chat | $3.201 M entrée |
| Claude Sonnet 5.5 claude-sonnet-5-5 | Anthropic | Chat | $1.601 M entrée |
| DeepSeek V4.1 Flash deepseek-flash | DeepSeek | Chat | $0.301 M entrée |
| GPT-6.1 Sol gpt-6.1-sol | OpenAI | Chat | $1.601 M entrée |
| GPT-5.5 gpt-5.5 | OpenAI | Chat | $3.001 M entrée |
| GPT-5.4 gpt-5.4 | OpenAI | Chat | $1.051 M entrée |
| Gemini 3.5 Flash gemini-3.5-flash | Chat | $0.901 M entrée | |
| GPT-5.2 gpt-5.2 | OpenAI | Chat | $0.4381 M entrée |
| Claude Opus 4.8 claude-opus-4-8 | Anthropic | Chat | $4.001 M entrée |
| Claude Opus 4.7 claude-opus-4-7 | Anthropic | Chat | $4.001 M entrée |
| Claude 4.6 API claude-sonnet-4-6 | Anthropic | Chat | $1.441 M entrée |
| Claude 4.5 Series claude-opus-4-5-20251101 | Anthropic | Chat | $0.801 M entrée |
| Gemini 3 Series gemini-3-flash-preview | Chat | $0.401 M entrée |
Questions fréquentes
Qu’est-ce que l’API de chat IA ?
+
Une API de chat IA accepte les messages de conversation et renvoie une réponse de modèle de langage. Il permet d'écrire, de raisonner, de coder et d'assister des fonctionnalités dans votre propre application. Les types d'entrée et les contrôles disponibles dépendent du modèle sélectionné et du protocole API.
Quel modèle d'API LLM dois-je choisir ?
+
Évaluez les modèles avec les invites, la durée des conversations et les résultats utilisés par votre produit. Comparez la qualité des réponses, le suivi des instructions, la vitesse et le coût des jetons. Incluez des exemples difficiles et infructueux dans l’évaluation plutôt que de choisir parmi une réponse impressionnante.
Tous les modèles de discussion PoYo utilisent-ils le même format de requête ?
+
Non. Utilisez la documentation du modèle pour choisir les complétions de conversation compatibles OpenAI, le format natif Claude Messages ou Gemini. Les structures des messages, les détails d'authentification et les contrôles pris en charge peuvent différer. Adaptez la requête au protocole documenté au lieu de changer uniquement le nom du modèle.
Comment préserver le contexte de conversation à plusieurs tours ?
+
Stockez les messages pertinents dans votre application et envoyez l'historique requis par le protocole sélectionné. Restez dans la limite du contexte du modèle et supprimez ou résumez les éléments qui ne facilitent plus la tâche. Il ne faut pas supposer qu’une nouvelle requête API mémorise automatiquement les requêtes antérieures.
L'API de chat IA prend-elle en charge les réponses en streaming ?
+
Vérifiez la prise en charge du streaming et les options de demande pour le modèle et le point de terminaison choisis. Si disponible, gérez les événements partiels, l'achèvement et les erreurs dans votre client. Conservez un chemin sans flux lorsque votre flux de travail nécessite une réponse complète avant la validation ou le traitement en aval.
Puis-je envoyer des images ou d'autres médias à un modèle de discussion ?
+
Utilisez uniquement les types de médias et les structures de messages documentés pour ce modèle. Certains points de terminaison LLM contiennent uniquement du texte et d'autres prennent en charge les entrées multimodales. Vérifiez les limitations de taille, de format et de contenu avant de mettre en œuvre les téléchargements, et testez dans quelle mesure le modèle gère vos médias réels.
Puis-je demander JSON ou une autre réponse structurée ?
+
Certains modèles exposent des contrôles de sortie structurés ; d'autres ne peuvent être guidés que par des invites. Confirmez le mécanisme pris en charge, fournissez un schéma clair le cas échéant et validez les données renvoyées dans votre application. Ne considérez pas une requête JSON comme une preuve que chaque réponse satisfera votre schéma.
Un modèle de chat peut-il naviguer sur le Web ou appeler des outils automatiquement ?
+
Uniquement lorsque le point de terminaison prend en charge la fonctionnalité et que votre application fournit ou active les outils requis. Un modèle peut décrire un appel d'outil sans l'exécuter. Vérifiez le protocole de l'outil documenté et gardez l'exécution, les autorisations et la gestion des résultats explicites dans votre intégration.
Comment puis-je réduire les réponses inexactes au chat IA ?
+
Fournissez des sources pertinentes, précisez la tâche et demandez au modèle de distinguer les informations manquantes des faits connus. Validez les résultats importants par rapport à des données fiables et testez les cas de défaillance récurrents. Le choix du modèle et les incitations peuvent améliorer la qualité, mais les réponses générées nécessitent toujours un examen approprié.
Comment le prix de l'API de chat IA est-il calculé ?
+
La tarification du chat sépare généralement les jetons d'entrée et de sortie, et certains modèles ont des distinctions de niveau supplémentaires. Lisez la tarification du modèle sélectionné et la réponse à l'utilisation. Incluez l’historique des conversations dans votre estimation, car l’envoi répété d’un long contexte peut augmenter le coût de chaque tour.
Que dois-je faire en cas d'erreurs de contexte, de limites de débit ou de délais d'attente ?
+
Vérifiez l'erreur renvoyée et les limites du modèle sélectionné. Réduisez le contexte surdimensionné, contrôlez les requêtes simultanées et utilisez des tentatives limitées le cas échéant. Pour une réponse en streaming partielle, enregistrez ce qui a été reçu et décidez comment votre application doit récupérer au lieu de dupliquer silencieusement un tour de conversation.
Où puis-je trouver des exemples d'intégration d'API de chat IA ?
+
Ouvrez la page de modèle et sa documentation API pour connaître le point de terminaison, l'authentification, le corps du message et les exemples corrects. La ressource llms.txt spécifique au modèle identifie également le protocole. Conservez les clés sur le serveur et validez les sorties avant de les utiliser dans des actions commerciales automatisées.
Explorer tous les modèles IA
Ouvrez le marché complet pour comparer les modèles image, vidéo, audio, chat, 3D et outils.
Voir tous les modèlesConstruire avec l'API
Ouvrez la page du modèle pour consulter paramètres, tarifs et documentation API.
Docs APIPages de tâches associées