API de chat com IA

APIs de IA para desenvolvedores

API de chat com IA

Crie recursos de escrita, raciocínio e codificação com a API de chat com IA PoYo. Compare modelos LLM, protocolos de conversação, entradas suportadas, controles de resposta e preços de tokens.

Modelos compatíveis

27 modelos

Kimi K3
Chat

$2.28 1 M entrada

kimi-k3

Moonshot AI's 2.8T-parameter flagship multimodal model with a 1M-token context window, built for long-horizon coding, deep reasoning, knowledge work, and tool-using agents.

Claude Sonnet 5
Chat

$0.85 1 M entrada

claude-sonnet-5

Claude Sonnet 5 API access for agentic coding, long-running agents, browser and computer use, professional workflows, 1M context, and up to 128K output.

DeepSeek V4 Flash
Chat

$0.112 1 M entrada

deepseek-v4-flash

DeepSeek V4 Flash is a fast, economical DeepSeek V4 API model with 1M-context chat, 284B total parameters, and 13B active parameters.

DeepSeek V4 Pro
Chat

$0.348 1 M entrada

deepseek-v4-pro

DeepSeek V4 Pro is a stronger reasoning, coding, and agent workflow model with 1M-context chat, 1.6T total parameters, and 49B active parameters.

GPT-6 Astra
Chat

$8.00 1 M entrada

gpt-6-astra

GPT-6 Astra API for advanced reasoning, coding, and agent workflows. Use Chat Completions or Responses with pay-as-you-go pricing on PoYo.

GPT-6 Sol
Chat

$1.60 1 M entrada

gpt-6-sol

GPT-6 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

Claude Fable 5.1
Chat

$8.00 1 M entrada

claude-fable-5-1

Anthropic's most capable generally available model for long-horizon coding, knowledge work, research, vision, 1M context, and up to 128K output.

Gemini 3.7 Flash
Chat

$0.06 1 M entrada

gemini-3.7-flash

Google's GA Flash model for agentic coding, multimodal reasoning, web development, long-context knowledge work, and tool-using applications.

Gemini 3.8 Flash
Chat

$0.06 1 M entrada

gemini-3.8-flash

Google's best reasoning and coding Flash model for long-horizon software engineering, autonomous agents, and enterprise workflows.

GPT-5.6
Chat

$0.056 1 M entrada

gpt-5-6-luna

GPT-5.6 API access for Sol, Terra, and Luna through the Responses API, from high-throughput automation to frontier coding and agent workflows.

GPT-6 Luna
Chat

$0.08 1 M entrada

gpt-6-luna

GPT-6 Luna API on PoYo. Use Chat Completions or Responses at $0.08 input and $0.4 output per million tokens, 20% below official standard rates.

Grok 4.6
Chat

$1.60 1 M entrada

grok-4.6

xAI's frontier model for long-running agents, coding, engineering, knowledge work, and ambitious interactive or visual projects.

Grok 4.7
Chat

$1.60 1 M entrada

grok-4.7

Grok 4.7 API on PoYo. Use Chat Completions at $1.6 input and $4.8 output per million tokens, 20% below official standard rates.

Claude Opus 5
Chat

$2.00 1 M entrada

claude-opus-5

Anthropic's flagship agentic model for advanced coding, long-horizon execution, computer use, deep research, and professional knowledge work.

Claude Opus 5.5
Chat

$3.20 1 M entrada

claude-opus-5-5

Claude Opus 5.5 API on PoYo. Use Chat Completions or Claude Messages at $3.2 input and $16 output per million tokens, 20% below official standard rates.

Claude Sonnet 5.5
Chat

$1.60 1 M entrada

claude-sonnet-5-5

Claude Sonnet 5.5 API on PoYo. Use Chat Completions or Claude Messages at $1.6 input and $8 output per million tokens, 20% below official standard rates.

DeepSeek V4.1 Flash
Chat

$0.30 1 M entrada

deepseek-flash

DeepSeek V4.1 Flash is a 552B MoE chat model with native vision, 1M context, 384K max output, and 8B/16B active parameters for cheaper agent workloads.

GPT-6.1 Sol
Chat

$1.60 1 M entrada

gpt-6.1-sol

GPT-6.1 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

GPT-5.5
Chat

$3.00 1 M entrada

gpt-5.5

GPT-5.5 API access for chat, coding, reasoning, and production agent workflows.

GPT-5.4
Chat

$1.05 1 M entrada

gpt-5.4

GPT-5.4 API access for chat, coding, reasoning, and production agent workflows.

Gemini 3.5 Flash
Chat

$0.90 1 M entrada

gemini-3.5-flash

Gemini 3.5 Flash API access for chat, coding, reasoning, and production agent workflows.

GPT-5.2
Chat

$0.438 1 M entrada

gpt-5.2

GPT-5.2 API access for chat, coding, reasoning, and production agent workflows.

Claude Opus 4.8
Chat

$4.00 1 M entrada

claude-opus-4-8

Claude Opus 4.8 supports long-context chat, agentic coding, professional reasoning, high-output workflows, 1M context, and up to 128K output.

Claude Opus 4.7
Chat

$4.00 1 M entrada

claude-opus-4-7

Anthropic's most capable generally available model for frontier coding, deep reasoning, and high-resolution vision.

Claude 4.6 API
Chat

$1.44 1 M entrada

claude-sonnet-4-6

Claude Sonnet 4.6 and Claude Opus 4.6 API access for coding, agents, computer use, and long-context reasoning.

Claude 4.5 Series
Chat

$0.80 1 M entrada

claude-opus-4-5-20251101

Anthropic's Claude 4.5 series model — Opus, Sonnet & Haiku

Gemini 3 Series
Chat

$0.40 1 M entrada

gemini-3-flash-preview

Google's Gemini 3 series model — Flash Preview & Pro Preview

APIs de modelos Chat - Preços e adequação

Compare fornecedores, entradas aceitas, formatos de saída e preços antes de escolher um modelo.

Correspondência exata

Os modelos aparecem aqui somente quando os metadados do catálogo incluem Chat.

Comparação de provedores

Compare famílias de modelos de vários provedores sem sair do diretório de tarefas.

Caminhos prontos para API

Cada cartão leva a preços da PoYo, exemplos, playground e detalhes da API.

ModeloProvedorTipos de tarefaPreço
Kimi K3

kimi-k3

Moonshot AIChat$2.281 M entrada
Claude Sonnet 5

claude-sonnet-5

AnthropicChat$0.851 M entrada
DeepSeek V4 Flash

deepseek-v4-flash

DeepSeekChat$0.1121 M entrada
DeepSeek V4 Pro

deepseek-v4-pro

DeepSeekChat$0.3481 M entrada
GPT-6 Astra

gpt-6-astra

OpenAIChat$8.001 M entrada
GPT-6 Sol

gpt-6-sol

OpenAIChat$1.601 M entrada
Claude Fable 5.1

claude-fable-5-1

AnthropicChat$8.001 M entrada
Gemini 3.7 Flash

gemini-3.7-flash

GoogleChat$0.061 M entrada
Gemini 3.8 Flash

gemini-3.8-flash

GoogleChat$0.061 M entrada
GPT-5.6

gpt-5-6-luna

OpenAIChat$0.0561 M entrada
GPT-6 Luna

gpt-6-luna

OpenAIChat$0.081 M entrada
Grok 4.6

grok-4.6

xAIChat$1.601 M entrada
Grok 4.7

grok-4.7

xAIChat$1.601 M entrada
Claude Opus 5

claude-opus-5

AnthropicChat$2.001 M entrada
Claude Opus 5.5

claude-opus-5-5

AnthropicChat$3.201 M entrada
Claude Sonnet 5.5

claude-sonnet-5-5

AnthropicChat$1.601 M entrada
DeepSeek V4.1 Flash

deepseek-flash

DeepSeekChat$0.301 M entrada
GPT-6.1 Sol

gpt-6.1-sol

OpenAIChat$1.601 M entrada
GPT-5.5

gpt-5.5

OpenAIChat$3.001 M entrada
GPT-5.4

gpt-5.4

OpenAIChat$1.051 M entrada
Gemini 3.5 Flash

gemini-3.5-flash

GoogleChat$0.901 M entrada
GPT-5.2

gpt-5.2

OpenAIChat$0.4381 M entrada
Claude Opus 4.8

claude-opus-4-8

AnthropicChat$4.001 M entrada
Claude Opus 4.7

claude-opus-4-7

AnthropicChat$4.001 M entrada
Claude 4.6 API

claude-sonnet-4-6

AnthropicChat$1.441 M entrada
Claude 4.5 Series

claude-opus-4-5-20251101

AnthropicChat$0.801 M entrada
Gemini 3 Series

gemini-3-flash-preview

GoogleChat$0.401 M entrada

Perguntas frequentes

O que é a API de chat com IA?

+

Uma API de chat de IA aceita mensagens de conversação e retorna uma resposta de modelo de linguagem. Ele permite recursos de escrita, raciocínio, codificação e assistente em seu próprio aplicativo. Os tipos de entrada e controles disponíveis dependem do modelo selecionado e do protocolo API.

Qual modelo de API LLM devo escolher?

+

Avalie modelos com os prompts, durações das conversas e resultados que seu produto usa. Compare a qualidade da resposta, o seguimento das instruções, a velocidade e o custo do token. Inclua exemplos difíceis e malsucedidos na avaliação, em vez de selecionar apenas uma resposta impressionante.

Todo modelo de chat PoYo usa o mesmo formato de solicitação?

+

Não. Use a documentação do modelo para escolher conclusões de bate-papo compatíveis com OpenAI, formato nativo Claude Messages ou Gemini. Estruturas de mensagens, detalhes de autenticação e controles suportados podem ser diferentes. Adapte a solicitação ao protocolo documentado em vez de alterar apenas o nome do modelo.

Como preservo o contexto de conversação multiturno?

+

Armazene as mensagens relevantes em sua aplicação e envie o histórico exigido pelo protocolo selecionado. Mantenha-se dentro do limite de contexto do modelo e remova ou resuma o material que não ajuda mais na tarefa. Não se deve presumir que uma nova solicitação de API se lembre automaticamente de solicitações anteriores.

A API de bate-papo IA oferece suporte a respostas de streaming?

+

Verifique o suporte de streaming e as opções de solicitação para o modelo e endpoint escolhido. Se disponível, lide com eventos parciais, conclusão e erros no seu cliente. Mantenha um caminho sem streaming quando seu fluxo de trabalho precisar de uma resposta completa antes da validação ou do processamento downstream.

Posso enviar imagens ou outras mídias para um modelo de chat?

+

Use apenas tipos de mídia e estruturas de mensagens documentadas para esse modelo. Alguns terminais LLM são somente texto e outros suportam entradas multimodais. Verifique as limitações de tamanho, formato e conteúdo antes de implementar uploads e teste quão bem o modelo lida com sua mídia real.

Posso solicitar JSON ou outra resposta estruturada?

+

Alguns modelos expõem controles de saída estruturados; outros só podem ser guiados por instruções. Confirme o mecanismo suportado, forneça um esquema claro quando disponível e valide os dados retornados em seu aplicativo. Não trate uma solicitação de JSON como prova de que cada resposta satisfará seu esquema.

Um modelo de chat pode navegar na web ou chamar ferramentas automaticamente?

+

Somente quando o endpoint suporta o recurso e seu aplicativo fornece ou ativa as ferramentas necessárias. Um modelo pode descrever uma chamada de ferramenta sem executá-la. Verifique o protocolo da ferramenta documentado e mantenha a execução, as permissões e o tratamento de resultados explícitos em sua integração.

Como posso reduzir respostas imprecisas de chat de IA?

+

Forneça material de origem relevante, torne a tarefa precisa e peça ao modelo para distinguir informações faltantes de fatos conhecidos. Valide resultados importantes em relação a dados confiáveis e teste casos de falha recorrentes. A escolha e a solicitação do modelo podem melhorar a qualidade, mas as respostas geradas ainda precisam de uma revisão apropriada.

Como é calculado o preço da API de bate-papo IA?

+

Os preços do chat geralmente separam tokens de entrada e saída, e alguns modelos têm distinções de níveis adicionais. Leia o preço do modelo selecionado e a resposta de uso. Inclua o histórico de conversas em sua estimativa, pois o envio repetido de contexto longo pode aumentar o custo de cada turno.

O que devo fazer em relação a erros de contexto, limites de taxa ou tempos limite?

+

Verifique o erro retornado e os limites do modelo selecionado. Reduza o contexto superdimensionado, controle solicitações simultâneas e use novas tentativas limitadas quando apropriado. Para uma resposta de streaming parcial, registre o que foi recebido e decida como seu aplicativo deve se recuperar em vez de duplicar silenciosamente uma conversa.

Onde posso encontrar exemplos de integração de API de bate-papo com IA?

+

Abra a página do modelo e sua documentação de API para o endpoint correto, autenticação, corpo da mensagem e exemplos. O recurso llms.txt específico do modelo também identifica o protocolo. Mantenha as chaves no servidor e valide os resultados antes de usá-los em ações comerciais automatizadas.